{"as_of":"2026-08-13T02:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e736186dbbe2ceda0a848e547496f5fa6f75d13476a638c01002db26b8afa23","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:00:58.319023Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:14:46.004752Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15734","snapshot_observed_at":"2026-08-06T23:14:46.004752Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19187","last_updated":"2025-06-23T23:22:11Z","snapshot_observed_at":"2026-08-08T05:07:37.542566Z","submitted_at":"2025-06-23T23:22:11Z","title":"Prompt, Translate, Fine-Tune, Re-Initialize, or Instruction-Tune? Adapting LLMs for In-Context Learning in Low-Resource Languages","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T23:14:46.004752Z"},"links":{"cited_paper":"/paper/2411.15734","citing_paper":"/paper/2506.19187"},"observation_digest":"sha256:53c3666638bbe1a5a4573015c463f0211345aad2fb6c328b2f16d5b9cb8a1d87","observation_id":"37ee4ca4-7868-40ed-b45f-5ca1de194690","resolution":{"observed_at":"2026-08-06T23:14:46.004752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.15734/citation-record","integrity":"/paper/2411.15734/integrity","json":"/paper/2411.15734/citation-record.json","paper":"/paper/2411.15734"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:59.040470Z","title":"A bit of progress in language modeling","venue":null,"work_id":"6c8001ab-8cca-47e3-90f8-162755a089dc","year":2001},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.129398Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:ae2e908c8fc28612a5ce785bb3f11fa5461985153afaa34462a5fbdc8473c61a","observation_id":"d55a9411-4a46-4163-b7a9-43278f24d1c0","resolution":{"observed_at":"2026-08-12T14:00:59.048129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:59.020028Z","title":"Recurrent neural network based language model","venue":null,"work_id":"4fa38195-ec56-4994-99ce-50cc4b30ffec","year":2010},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.134733Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:5c08c84018b1927a8d700c59c9cb9f4ce6de8eef14982f17da0862ce41905d25","observation_id":"655902c7-58f9-4fdc-8e0d-88cf7d1de70b","resolution":{"observed_at":"2026-08-12T14:00:59.026234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:59.001344Z","title":"Lstm neural networks for language modeling","venue":null,"work_id":"5f45147f-8fec-4108-bd7e-f07cdbaf8a1e","year":2012},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.139728Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:03cb4b35fca0c6b94a8adb3842c334fb376c6e52b504605b9c3d4d2be5e6ee99","observation_id":"698ddcf0-1706-419d-891e-e229caee0687","resolution":{"observed_at":"2026-08-12T14:00:59.007401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.980302Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"c9173311-e147-44e7-a70b-7048bb492531","year":2017},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.146114Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:0596993d15f3ac3bae04ba4f3efb84fdd892cca35b3473111f7038403f2b3b07","observation_id":"fe804469-d516-4fe2-8ee3-f98380a31c1c","resolution":{"observed_at":"2026-08-12T14:00:58.987056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05365","last_updated":"2018-03-22T21:59:40Z","snapshot_observed_at":"2026-07-06T06:23:28.649177Z","submitted_at":"2018-02-15T00:05:11Z","title":"Deep contextualized word representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05365","snapshot_observed_at":"2026-08-12T14:00:58.151149Z","title":"Peters, Mark Neumann, Mohit Iyyer, Matt Gardner, Christopher Clark, Kenton Lee, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.151149Z"},"links":{"cited_paper":"/paper/1802.05365","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:fbf906341baaa5e6ba1ebb392cd225777cb81326dd8b83745b95e5d5a8d98234","observation_id":"37e4a4a1-ae0a-4465-abfe-d3aa4ae9bc89","resolution":{"observed_at":"2026-08-12T14:00:58.151149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.965479Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"ec244a07-0bc5-4373-8c84-7de3f7a3217b","year":2019},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.156171Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:2ad949b1a268f6853e4e9487ccff52e9064fe6c35e3962937af6d969f110561d","observation_id":"9c79f388-ed44-4782-ba9c-797c58ff1234","resolution":{"observed_at":"2026-08-12T14:00:58.970475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.949219Z","title":"Improving language understanding with unsupervised learning","venue":null,"work_id":"d5c3fb8d-ecac-494d-9c67-82510c47b71b","year":2018},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.161576Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:8f6ab1a1ce3aac8338c1295215d80d37edb803a50d5d1943368aac948a4e481e","observation_id":"8ff249b6-6a69-4643-a4f6-8c8d5aad4c80","resolution":{"observed_at":"2026-08-12T14:00:58.954340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-13T01:55:08.127780Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-12T14:00:58.166028Z","title":"Zhao, Kelvin Guu, Adams Wei Yu, Brian Lester, Nan Du, Andrew M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.166028Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:ee492d435659098d2869c3e9187bb498c8ac04df4abb2504b8d206fb8b10c364","observation_id":"8cbe3e15-738d-4fd7-9b4d-85798f85a9b2","resolution":{"observed_at":"2026-08-12T14:00:58.166028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-07-06T14:33:11.945106Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-12T14:00:58.170969Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.170969Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:8f85c7e8de10b99e9f22947782c8d4f031c884a2b2353a8102600cacf614d2f8","observation_id":"3b223f95-9fb6-41cd-bc00-15a66825db3e","resolution":{"observed_at":"2026-08-12T14:00:58.170969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.932675Z","title":"Nepberta: Nepali language model trained in a large corpus","venue":null,"work_id":"e06dd8af-18a3-4a0b-b6ab-0512e0ee39df","year":2022},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.175784Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:7b461b4bc09ce33a506d32168997ef4cb2745250172e94c233f40e87b70fe688","observation_id":"41da3195-5349-499e-9a78-f860c75ec437","resolution":{"observed_at":"2026-08-12T14:00:58.937918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.915003Z","title":"Structure of Nepali Grammar","venue":null,"work_id":"76a7309f-e3c4-476f-8d9a-127cd2adf727","year":2004},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.180917Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:b4723792a68884655133f60b459107ca3b78de5c3998fc3410a41192f602bda4","observation_id":"08366ac8-ca39-4871-97f4-82bc437f3a82","resolution":{"observed_at":"2026-08-12T14:00:58.920568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-12T14:00:58.185706Z","title":"Efficient estimation of word representations in vector space","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.185706Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:772a4d1ceda22b4c1b239373c554d7a1412948e516008387cf9945a905a2fb33","observation_id":"cdf78b79-e8f6-4bd9-aed8-4606489b548a","resolution":{"observed_at":"2026-08-12T14:00:58.185706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.897296Z","title":"Glove: Global vectors for word representation","venue":null,"work_id":"130dd43a-94e3-450d-8d1a-a9be486f227c","year":2014},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.191779Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:bbd5767a4ca4e4c2c47e4a6ea924a38b3b893f789163d3ae61b7c82a2eff8747","observation_id":"322c1b16-4e0a-4fd9-aee8-f7ec63555850","resolution":{"observed_at":"2026-08-12T14:00:58.902666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-12T14:00:58.197201Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.197201Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:69e4e16902b0d0dcb94b7389b6ba4dcbfcd0bf32af5c9f0ccae2e6a92556e55d","observation_id":"58b4b174-f6f6-45cb-82da-111d6589ff75","resolution":{"observed_at":"2026-08-12T14:00:58.197201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.881972Z","title":"Le, and Christopher D","venue":null,"work_id":"62e16453-a723-4616-a21e-f8e4dccfa8c3","year":2020},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.202040Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:e80c1f08fa62e32429f7324f295a6f7bf6d3a46258e679505e5d748d24b91322","observation_id":"6c2c7b13-2931-4eed-82ad-06683004c86d","resolution":{"observed_at":"2026-08-12T14:00:58.886636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-12T14:00:58.206761Z","title":"Deberta: Decoding-enhanced bert with disentangled attention","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.206761Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:c751507a5c11aa731895cb2206f2c9bc0a1b5cc28747f6b9c40bb9d91bcc27e4","observation_id":"41493034-0c3f-48ba-b3e1-46ce97aed0d3","resolution":{"observed_at":"2026-08-12T14:00:58.206761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01502","last_updated":"2019-06-04T15:12:47Z","snapshot_observed_at":"2026-08-11T01:09:49.593481Z","submitted_at":"2019-06-04T15:12:47Z","title":"How multilingual is Multilingual BERT?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01502","snapshot_observed_at":"2026-08-12T14:00:58.211723Z","title":"How multilingual is multilingual bert? arXiv preprint arXiv:1906.01502 , 2019","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.211723Z"},"links":{"cited_paper":"/paper/1906.01502","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:e805b07fa3b079e9aacf4f202ee68394011a49ca0edee7c4b9d9e8ffd0fa1258","observation_id":"e67c1320-1a84-4876-a2e2-06658263a00c","resolution":{"observed_at":"2026-08-12T14:00:58.211723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.865344Z","title":"Cross-lingual language model pre-training","venue":null,"work_id":"d9321247-98ca-412d-b1a2-e96c258954ab","year":2019},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.216587Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:489708fe2de08eaac5d1da642ab48755811814531e7304a9c1b372fc084c683a","observation_id":"bf0fe575-f61e-4915-bf97-53e5989e8f21","resolution":{"observed_at":"2026-08-12T14:00:58.870625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02116","last_updated":"2020-04-08T01:02:17Z","snapshot_observed_at":"2026-08-02T09:09:10.011185Z","submitted_at":"2019-11-05T22:42:00Z","title":"Unsupervised Cross-lingual Representation Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02116","snapshot_observed_at":"2026-08-12T14:00:58.220920Z","title":"Unsupervised cross-lingual representation learning at scale","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.220920Z"},"links":{"cited_paper":"/paper/1911.02116","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:e2d35d5e4908c4768de226b1386ca68799e1cdb11a89adf775a3ece0f9a470e1","observation_id":"b09e6132-caaf-49c1-90ee-e89b6b09b1e3","resolution":{"observed_at":"2026-08-12T14:00:58.220920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06546","last_updated":"2021-04-13T23:18:04Z","snapshot_observed_at":"2026-08-11T03:50:39.096999Z","submitted_at":"2021-04-13T23:18:04Z","title":"Large-Scale Contextualised Language Modelling for Norwegian","version":1},"cited_work":{"arxiv_id":"2104.06546","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.06546","snapshot_observed_at":"2026-08-12T14:00:58.440590Z","title":"Large-Scale Contextualised Language Modelling for Norwegian","venue":"cs.CL","work_id":"11b36c90-7215-4aba-8b90-e305207f186d","year":2021},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.225965Z"},"links":{"cited_paper":"/paper/2104.06546","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:7a4a617def4e1fdcf8bcdf4810fd3de09d4e4e95fe5cf8f3bd3b52789e0656d9","observation_id":"58084817-1eff-4218-904d-4ea1850224da","resolution":{"observed_at":"2026-08-12T14:00:58.448712Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.07076","last_updated":"2019-12-15T17:50:56Z","snapshot_observed_at":"2026-08-11T17:51:16.697278Z","submitted_at":"2019-12-15T17:50:56Z","title":"Multilingual is not enough: BERT for Finnish","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.07076","snapshot_observed_at":"2026-08-12T14:00:58.230923Z","title":"Multilingual is not enough: Bert for finnish","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.230923Z"},"links":{"cited_paper":"/paper/1912.07076","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:dbe8f0d64921e3339117040fa027aca19672dcf2094505a7ac4f4eee97797d3c","observation_id":"7a2e9e3d-1a00-4c2e-b670-003bd13e7aac","resolution":{"observed_at":"2026-08-12T14:00:58.230923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.844952Z","title":"Herbert: Efficiently pretrained transformer-based language model for polish","venue":null,"work_id":"5a4c834a-3b69-41ec-bfe0-a3194dd64c9e","year":null},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.235623Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:812f6c1bcc8ed2f6d3090c5b9536e67e9f7053770731f5b9ab2e9eccaae8a593","observation_id":"193c7844-4881-4a5f-b839-4c62f26f852a","resolution":{"observed_at":"2026-08-12T14:00:58.850665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.827562Z","title":"German’s next language model","venue":null,"work_id":"69bc2097-37a7-490d-89ab-414e4e586ff5","year":2020},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.240470Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:c92ea1bbb30efb83995fa2c84706900c4834cf33fbd4ca088a3d4b0c27dd8d57","observation_id":"c3b7ab19-170d-4e71-b34b-65287b60b41c","resolution":{"observed_at":"2026-08-12T14:00:58.832503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.809618Z","title":"Pre-training with whole word masking for chinese bert","venue":null,"work_id":"536551de-4871-473b-a48b-5ae227dba586","year":2021},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.246804Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:8d1700c494a6949915001df868961455a57bacab2f558266704df536bb37f1e9","observation_id":"afc702d0-2eb3-4de5-be59-55efd76a061d","resolution":{"observed_at":"2026-08-12T14:00:58.815866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05409","last_updated":"2023-05-24T17:05:16Z","snapshot_observed_at":"2026-07-06T14:29:08.672751Z","submitted_at":"2022-12-11T04:45:50Z","title":"Towards Leaving No Indic Language Behind: Building Monolingual Corpora, Benchmark and Models for Indic Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05409","snapshot_observed_at":"2026-08-12T14:00:58.251316Z","title":"Khapra, Anoop Kunchukuttan, and Pratyush Kumar","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.251316Z"},"links":{"cited_paper":"/paper/2212.05409","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:2afcaa4ec1a1112a9775e08f3276e3a2f35e525586baf65fc0fc21213f094ce5","observation_id":"74ed3c41-153d-4db1-81fd-2d56a330c01b","resolution":{"observed_at":"2026-08-12T14:00:58.251316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.786682Z","title":"Nepalibert: Pre-training of masked language model in nepali corpus","venue":null,"work_id":"60741911-6480-4533-9eac-896e5f9b298c","year":2023},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.255979Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:c66c01db80c945c4833a4e005826c9e1e8b63f2faf1c48770b8fc4b001ddc270","observation_id":"c7accd04-0a29-4574-9013-54b19650af28","resolution":{"observed_at":"2026-08-12T14:00:58.793638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.765509Z","title":null,"venue":null,"work_id":"04ee2410-00ea-462f-a350-187ed2bb72cc","year":2022},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.260545Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:ca8e88946eebed74b28a6e300af002f9e0101eae2b1086e22a6545e98b0bb06d","observation_id":"e1eeabd9-7b95-4047-b71f-688d6aa72523","resolution":{"observed_at":"2026-08-12T14:00:58.771853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.748385Z","title":"inltk: Natural language toolkit for indic languages","venue":null,"work_id":"548d8a11-b46a-4ae7-8b0d-ee8ccc29e23f","year":2020},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.265448Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:0ae31858f87809901f9b58d27427ed7f5867b44442e9a668c68f61f0faebe00d","observation_id":"05761014-a63d-4798-b07b-ea19db7c9930","resolution":{"observed_at":"2026-08-12T14:00:58.753756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.728138Z","title":"Asynchronous pipeline for processing huge corpora on medium to low resource infrastructures","venue":null,"work_id":"8a630c84-87e6-46dc-9c5d-b625867c6b4c","year":2019},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.269915Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:05ff90b3d4fb6c251641f233b735a08b82f054289055f6e31283e913e0f6e3cf","observation_id":"8a6b0de1-0705-442f-9af5-384be5b8223f","resolution":{"observed_at":"2026-08-12T14:00:58.733770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.707596Z","title":"alpaca-nepali-sft, 2024","venue":null,"work_id":"d4a3f4e4-e734-4617-a9bf-3fa3bdbc7563","year":2024},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.274532Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:9262df086fb09ff26b59d8baceccc2fda700c1848a1ab84cb62ef032f3b176f1","observation_id":"42de184b-7840-43b3-8e0f-cba64a3ae554","resolution":{"observed_at":"2026-08-12T14:00:58.713085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-12T14:00:58.279202Z","title":"Le, Mohammad Norouzi, Wolfgang Macherey, Maxim Krikun, Yuan Cao, Qin Gao, Klaus Macherey, et al","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.279202Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:314ca00bcdf53e9302818d39bada4465f21ef16b7f75f62afbb8a7ee486448c9","observation_id":"446328b6-02e7-4313-a504-4ecaba63cba9","resolution":{"observed_at":"2026-08-12T14:00:58.279202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.688327Z","title":"Neural machine translation of rare words with subword units","venue":null,"work_id":"85ef5a15-0081-4331-bc3f-422e7972e385","year":2016},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.285318Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:2427e99e639f9d51734bf15bdfb53c4451750cd68241d45aa42842d5f14eecab","observation_id":"93660c88-f133-415c-b483-04b790f2321b","resolution":{"observed_at":"2026-08-12T14:00:58.693774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T14:00:58.290359Z","title":"Kingma and Jimmy Lei Ba","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.290359Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:d2142fce99299e6ab34b71541258df2fd97785f2c71d0e4449807fde64089cd4","observation_id":"bd830309-f19c-4da6-a75c-2c1cb1468a5f","resolution":{"observed_at":"2026-08-12T14:00:58.290359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-12T14:00:58.295505Z","title":"Gaussian error linear units","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.295505Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:d89dac38190e46af9bf019e3b68fc43a2faf4d7731d9ce07eed95d3859e46978","observation_id":"3438e3ae-01da-431e-8627-b1da78d68acd","resolution":{"observed_at":"2026-08-12T14:00:58.295505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.300200Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.300200Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:6f51a4b688b80abf05df3cccb7493c6bac5e8c6febff454d88392d24760b1e37","observation_id":"3e752985-ac05-4881-9775-0a82b2ecc486","resolution":{"observed_at":"2026-08-12T14:00:58.300200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.657015Z","title":"Nepalibert, 2021","venue":null,"work_id":"034c9339-1d22-40c8-b430-25d0a6881edb","year":2021},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.304846Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:b7b20ea04768efce09da7ba7cd51a82a2edfb5b236ed6d312de934291f266dab","observation_id":"d26cdee8-8078-4e88-90e9-a1194e0396a6","resolution":{"observed_at":"2026-08-12T14:00:58.662104Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.641068Z","title":"Xlsum-nepali-summerization-dataset, 2024","venue":null,"work_id":"7d04d705-23dc-4334-9136-44a84c94fd86","year":2024},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.309327Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:3bca43da71bd0729e01b3b6699ab59d822c7077fa91bbab5f0d2fea064475d5b","observation_id":"7aec4fb3-1dfb-4b72-9c14-3c18e879cfef","resolution":{"observed_at":"2026-08-12T14:00:58.646227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.620383Z","title":"Automatic evaluation of machine translation quality using longest common subsequence and skip-bigram statistics","venue":null,"work_id":"bf286f72-6b69-4933-8d1e-2e4caa4cd194","year":2004},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.314415Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:1ea8c30b03895e79be9ed2b4977f986a9d56fa4b2d7ec30ddf6c1c4365359480","observation_id":"f1cb257f-cded-4914-bb11-e9cdd93c9bda","resolution":{"observed_at":"2026-08-12T14:00:58.627181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:00:58.599031Z","title":"Distilgpt2-nepali, 2022","venue":null,"work_id":"1ab6b04a-8058-448e-9085-0dba0d232f94","year":2022},"citing_paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T14:00:58.319023Z"},"links":{"citing_paper":"/paper/2411.15734"},"observation_digest":"sha256:c47d9fd5f9d7ef5258d671b7d3f4fe3871bea5a20da6e4d9cdd8aca1d0b14c3e","observation_id":"96236244-a829-4719-8459-49defed7a5f5","resolution":{"observed_at":"2026-08-12T14:00:58.606148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15734","last_updated":"2025-08-19T11:00:49Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T13:55:50.151004Z","submitted_at":"2024-11-24T06:38:24Z","title":"Development of Pre-Trained Transformer-based Models for the Nepali Language"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":15,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2411.15734."}