{"as_of":"2026-08-20T07:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef8e12b7578ade54bea29d9a4ad3b73e577089b89e609e709cf2769971ce2070","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:55:45.986790Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T05:02:18.347642Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:48:39.928976Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"cited_work":{"arxiv_id":"2505.05946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05946","snapshot_observed_at":"2026-07-03T16:48:39.928976Z","title":"Šliogeris, P","venue":null,"work_id":"6fb96369-c21d-47f5-9a51-815376db33d3","year":2025},"citing_paper":{"arxiv_id":"2605.15053","last_updated":"2026-05-15T02:16:20Z","snapshot_observed_at":"2026-08-15T10:10:11.114135Z","submitted_at":"2026-05-14T16:46:26Z","title":"TFGN: Task-Free, Replay-Free Continual Pre-Training Without Catastrophic Forgetting at LLM Scale","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T17:06:12.280460Z"},"links":{"cited_paper":"/paper/2505.05946","citing_paper":"/paper/2605.15053"},"observation_digest":"sha256:6fc792ed6205f55d2bbfe38c90263a12f70856f824baa2faec3076df4ce6c94b","observation_id":"ceada456-ab38-4e67-9a76-b76b836438e7","resolution":{"observed_at":"2026-05-19T17:07:41.541141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"cited_work":{"arxiv_id":"2505.05946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05946","snapshot_observed_at":"2026-07-03T16:48:39.928976Z","title":"Šliogeris, P","venue":null,"work_id":"6fb96369-c21d-47f5-9a51-815376db33d3","year":2025},"citing_paper":{"arxiv_id":"2606.24901","last_updated":"2026-06-12T13:44:48Z","snapshot_observed_at":"2026-08-03T03:21:51.293576Z","submitted_at":"2026-06-12T13:44:48Z","title":"LLM Evolution as an Industry-Scale Ecosystem: A Lifecycle Perspective on Continual Learning","version":1},"reference_index":150,"source":"pdf_text","source_observed_at":"2026-06-27T05:02:18.347642Z"},"links":{"cited_paper":"/paper/2505.05946","citing_paper":"/paper/2606.24901"},"observation_digest":"sha256:bb624fd99eef05a54e63c082d002ce43249b8c0558c32be0c33d1e91b5fb3596","observation_id":"cdd7dc52-bb2c-4d2f-8962-77f272e28d1d","resolution":{"observed_at":"2026-07-03T16:48:39.930294Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.05946/citation-record","integrity":"/paper/2505.05946/integrity","json":"/paper/2505.05946/citation-record.json","paper":"/paper/2505.05946"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.520803Z","title":"Attention is all you need","venue":null,"work_id":"6ef4214e-328e-43d1-87e2-c04ce9103da2","year":2017},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.839211Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:8f271ac38fac6216ea20e5cf1b1a8b4126a1ab80b17a0374d92e74ceb304f053","observation_id":"e5dc1b4d-340e-4485-b6c0-eeaa64e97972","resolution":{"observed_at":"2026-08-15T22:55:46.525323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.506753Z","title":"Bring Your Own Knowledge: A Survey of Methods for LLM Knowledge Expansion, 2025","venue":null,"work_id":"cffa415d-89a1-484c-b05c-08c97cc20dc8","year":2025},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.844612Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:26a4bf66bee3c379938d917a9b22280c19c9b0c975bbff119eeb995c5f1b7ee3","observation_id":"82b5ce1d-8cea-4db4-a9a3-4c6145c21750","resolution":{"observed_at":"2026-08-15T22:55:46.511054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16789","last_updated":"2024-11-25T05:27:13Z","snapshot_observed_at":"2026-08-17T23:09:06.865859Z","submitted_at":"2024-04-25T17:38:57Z","title":"Continual Learning of Large Language Models: A Comprehensive Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16789","snapshot_observed_at":"2026-08-15T22:55:45.849387Z","title":"Continual learning of large language models: A comprehensive survey.arXiv preprint arXiv:2404.16789, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.849387Z"},"links":{"cited_paper":"/paper/2404.16789","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:1ff368655e07c728fd459c474f833ab7e6cdee50e94199e8a21f35c6b2ceace3","observation_id":"d0acec44-9979-4bde-9d5f-3b714c70d28c","resolution":{"observed_at":"2026-08-15T22:55:45.849387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.492454Z","title":"The MIT Press, Cambridge, 1965","venue":null,"work_id":"6064000e-92fb-4e96-8982-a010b1f63f90","year":1965},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.854700Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:a5f0bc2c898cb6e5730bfc1bc2439d728cc9937baca6d8f19e79938f2f767c24","observation_id":"1ba9bc21-6ca5-4d23-a298-34ad7dffefc3","resolution":{"observed_at":"2026-08-15T22:55:46.496916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.476625Z","title":"Overcoming Catastrophic Forgetting in Neural Networks.Proceedings of the national academy of sciences, 114(13):3521–3526, 2017","venue":null,"work_id":"378d2b01-7337-4a5c-a488-0485efffb9ff","year":2017},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.859707Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:c0efb1f136ac01d0b4b4fdc1a1d2d62da7a7780fa533d9a55cf58b72f34d4e7e","observation_id":"50ccf73e-11ea-4c52-99bf-90a2baf301be","resolution":{"observed_at":"2026-08-15T22:55:46.481460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02118","last_updated":"2024-10-02T06:32:10Z","snapshot_observed_at":"2026-08-17T23:10:47.862073Z","submitted_at":"2024-07-02T10:06:41Z","title":"Breaking Language Barriers: Cross-Lingual Continual Pre-Training at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02118","snapshot_observed_at":"2026-08-15T22:55:45.864261Z","title":"Breaking Language Barriers: Cross- Lingual Continual Pre-Training at Scale.arXiv preprint arXiv:2407.02118, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.864261Z"},"links":{"cited_paper":"/paper/2407.02118","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:d5c8fb8b10cbe2f161c464b44c683652b99c85f7a7bf6644562c8c114c373356","observation_id":"11daf383-8223-4096-9b71-6234ddcdae9d","resolution":{"observed_at":"2026-08-15T22:55:45.864261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12393","last_updated":"2022-10-29T09:19:01Z","snapshot_observed_at":"2026-08-17T23:12:34.724053Z","submitted_at":"2022-05-24T22:53:34Z","title":"Fine-tuned Language Models are Continual Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12393","snapshot_observed_at":"2026-08-15T22:55:45.869630Z","title":"Fine-tuned language models are continual learn- ers.arXiv preprint arXiv:2205.12393, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.869630Z"},"links":{"cited_paper":"/paper/2205.12393","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:3d490d0f6c1d3515e1a9ebd03c7406e6ee45290e66daaf3afc4756ad5b06fef2","observation_id":"afbcb2d5-bdaa-489d-8914-ea1258c57fc7","resolution":{"observed_at":"2026-08-15T22:55:45.869630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08763","last_updated":"2024-09-04T16:13:18Z","snapshot_observed_at":"2026-08-16T14:10:04.613423Z","submitted_at":"2024-03-13T17:58:57Z","title":"Simple and Scalable Strategies to Continually Pre-train Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08763","snapshot_observed_at":"2026-08-15T22:55:45.874320Z","title":"Simple and scalable strategies to continually pre-train large language models.arXiv preprint arXiv:2403.08763, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.874320Z"},"links":{"cited_paper":"/paper/2403.08763","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:555ff576b9a4fc0499adff8d4ea43eed01689c570cb2e107445b3edb707cdbc6","observation_id":"c87e7829-d4d4-42bb-b8a4-3c06c09805b7","resolution":{"observed_at":"2026-08-15T22:55:45.874320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03329","last_updated":"2019-12-23T04:36:52Z","snapshot_observed_at":"2026-08-19T06:42:08.768594Z","submitted_at":"2019-09-07T20:17:34Z","title":"LAMOL: LAnguage MOdeling for Lifelong Language Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.03329","snapshot_observed_at":"2026-08-15T22:55:45.879138Z","title":"LAMOL: LAnguage MOdeling for Lifelong Language Learn- ing.arXiv preprint arXiv:1909.03329, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.879138Z"},"links":{"cited_paper":"/paper/1909.03329","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:a26a974a7693b203bdffd73c37e440e3b204a52892028117323f26012e7755fb","observation_id":"b1715bdd-a4a9-4a41-a736-060a0707cba3","resolution":{"observed_at":"2026-08-15T22:55:45.879138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.460589Z","title":"Learning Without Forgetting","venue":null,"work_id":"f3753cc9-a7ef-41f5-aeca-60bd9177a67a","year":2016},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.884064Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:32312fb354b6084bf96befec413bb9e17ec552ee26c0cacf2972d6065aa12451","observation_id":"4aac1fb0-96ed-434c-b2f5-c159df85c7b9","resolution":{"observed_at":"2026-08-15T22:55:46.465648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.445132Z","title":"Learning to solve NLP tasks in an incremental number of languages","venue":null,"work_id":"b4f838b0-1bb2-4275-bd69-5ef6ae9de7c2","year":2021},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.888388Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:ce8bc479c85ad9e1484b7a91c5cc48e0992caaef9035b564d55e5e84c3cabf01","observation_id":"0a18f165-9e35-4ddc-8177-cd0202eb1982","resolution":{"observed_at":"2026-08-15T22:55:46.449852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.430294Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"0f61dab0-1023-46d7-9678-4c006bc4c2bf","year":2022},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.893289Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:43c6a2ffb0e88ce4b1460ff021da258ede455a912db67590883024372748a00e","observation_id":"b9b2c15b-b3cc-41fd-80c1-366af21d704d","resolution":{"observed_at":"2026-08-15T22:55:46.434986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.415607Z","title":"CURLoRA: Stable LLM Continual Fine-Tuning and Catastrophic Forgetting Mitigation, 2024","venue":null,"work_id":"6558c221-2a3a-42f2-9807-c82864ef1485","year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.897774Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:a6f9f0cb430d6d3261f76fababcd29ea729fc799f969bac43e4b8a4d67dee9f5","observation_id":"be4ad56f-ed2c-4785-a315-76b278609598","resolution":{"observed_at":"2026-08-15T22:55:46.420189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.400170Z","title":"Language models meet world models: Embodied experiences enhance language models.Advances in Neural Information Process- ing Systems, 36:75392–75412, 2023","venue":null,"work_id":"6db19fae-4405-49e3-b818-86e632a5c1f2","year":2023},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.902511Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:b7d5242c6fb56bef0c29b532e8db4570091441691c5baf50daa50829d2cf626a","observation_id":"b4a70fec-bc2a-4132-b0e8-851e5b0845a9","resolution":{"observed_at":"2026-08-15T22:55:46.405138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16252","last_updated":"2023-05-25T17:06:34Z","snapshot_observed_at":"2026-08-17T23:12:35.949435Z","submitted_at":"2023-05-25T17:06:34Z","title":"Overcoming Catastrophic Forgetting in Massively Multilingual Continual Learning","version":1},"cited_work":{"arxiv_id":"2305.16252","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.16252","snapshot_observed_at":"2026-08-15T22:55:46.147366Z","title":"Overcoming Catastrophic Forgetting in Massively Multilingual Continual Learning","venue":"cs.CL","work_id":"ab5db9e8-f9fb-4342-9991-711197af6600","year":2023},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.906968Z"},"links":{"cited_paper":"/paper/2305.16252","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:c91691e2d2d660de07e38e5dec8ea72cc20f998b41ed939e7d8d236a3b03ea3b","observation_id":"f45a1dd0-2145-4bad-8713-b9b723a27b0c","resolution":{"observed_at":"2026-08-15T22:55:46.152730Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.385460Z","title":"Unifying Importance Based Regularisation Methods for Continual Learning","venue":null,"work_id":"5456268a-ad0f-4803-938d-af7b01417958","year":null},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.911782Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:210516a93443a412404793fd708672ceddbf6fa5273b9f3a7cc4fd73d4d117f4","observation_id":"35cf8420-a712-4207-b0fc-bc9aad3f22b2","resolution":{"observed_at":"2026-08-15T22:55:46.390008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.368963Z","title":"van de Ven","venue":null,"work_id":"a538adaf-e017-4924-8afe-56b349780758","year":2025},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.916433Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:701b7ab49494751f5267fbb581b21cf92d7f40ce289ce3e46854daaa3ace9d04","observation_id":"4b7969c5-532f-4591-9a44-cb181917839f","resolution":{"observed_at":"2026-08-15T22:55:46.374637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03129","last_updated":"2024-01-06T05:34:09Z","snapshot_observed_at":"2026-08-17T23:11:52.011149Z","submitted_at":"2024-01-06T05:34:09Z","title":"Examining Forgetting in Continual Pre-training of Aligned Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03129","snapshot_observed_at":"2026-08-15T22:55:45.920900Z","title":"Examining forgetting in continual pre-training of aligned large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.920900Z"},"links":{"cited_paper":"/paper/2401.03129","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:545d67950fe29e48ff03caa86a5545285ba06139e0820e07e6dab0396270bafb","observation_id":"f642ff60-0197-4dd5-b20a-0de9ba0a6605","resolution":{"observed_at":"2026-08-15T22:55:45.920900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-15T22:55:45.925472Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.925472Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:dbf23681633ed4bc31b7ddd7cd2fe8965e82b213c77eaa645f65a1fe064e78a8","observation_id":"dd73bfee-9bfd-4836-b56f-55341cbfd7aa","resolution":{"observed_at":"2026-08-15T22:55:45.925472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09400","last_updated":"2023-09-17T23:49:10Z","snapshot_observed_at":"2026-08-19T23:22:07.740848Z","submitted_at":"2023-09-17T23:49:10Z","title":"CulturaX: A Cleaned, Enormous, and Multilingual Dataset for Large Language Models in 167 Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09400","snapshot_observed_at":"2026-08-15T22:55:45.930374Z","title":"Culturax: A cleaned, enormous, and multilingual dataset for large language models in 167 languages.arXiv preprint arXiv:2309.09400, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.930374Z"},"links":{"cited_paper":"/paper/2309.09400","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:144feb875174aa4004950f643fc4fc40cade3ce6b7015bae2c3d3b8e661957a6","observation_id":"f8619775-8d88-48de-aede-55cc71934158","resolution":{"observed_at":"2026-08-15T22:55:45.930374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12963","last_updated":"2024-08-23T10:18:39Z","snapshot_observed_at":"2026-08-17T23:12:37.214969Z","submitted_at":"2024-08-23T10:18:39Z","title":"Open Llama2 Model for the Lithuanian Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12963","snapshot_observed_at":"2026-08-15T22:55:45.935063Z","title":"Open Llama2 Model for the Lithuanian Language","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.935063Z"},"links":{"cited_paper":"/paper/2408.12963","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:8ea27bd4d43556bc2983da54a57baaa7261b1778c35675d8f2c4718c3fe3d061","observation_id":"1010db17-f03f-4b60-b256-d71eb4ba6c20","resolution":{"observed_at":"2026-08-15T22:55:45.935063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.353901Z","title":"Open Llama2 Models for the Lithuanian Language","venue":null,"work_id":"d0fcbdbf-cbd5-44e6-ac8f-1747236628f6","year":2025},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.939626Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:557c9bd6f113b3a1a896517461f943c8ad7026393c3175ef8862d40591d0f3a4","observation_id":"46c2bc39-d873-4557-9116-1bbd1280a35d","resolution":{"observed_at":"2026-08-15T22:55:46.358723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03952","last_updated":"2025-01-07T17:24:17Z","snapshot_observed_at":"2026-08-17T23:11:52.538556Z","submitted_at":"2025-01-07T17:24:17Z","title":"Localizing AI: Evaluating Open-Weight Language Models for Languages of Baltic States","version":1},"cited_work":{"arxiv_id":"2501.03952","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03952","snapshot_observed_at":"2026-08-15T22:55:46.059163Z","title":"Localizing AI: Evaluating Open-Weight Language Models for Languages of Baltic States","venue":"cs.CL","work_id":"9c6c69d5-a733-455b-b905-c9aa7f6bf88d","year":2025},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.944143Z"},"links":{"cited_paper":"/paper/2501.03952","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:cbc7fbfbf568dc364764bb9618f2778edb88b8041f09fcf279cff7cfb963d526","observation_id":"55dfaadb-56fb-4c26-8bdd-f836e10d5259","resolution":{"observed_at":"2026-08-15T22:55:46.066445Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.337691Z","title":"Align- ing AI With Shared Human Values.Proceedings of the International Conference on Learning Representations (ICLR), 2021","venue":null,"work_id":"9fc5cd71-ac70-4d25-b0af-6f9f2c71aa05","year":2021},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.948958Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:18d17529999691627443ed309e50733b9c2d9b5534f83e3e0033ea4729b6fb28","observation_id":"1c5527ce-923f-40fb-82bd-cdc2204e58a6","resolution":{"observed_at":"2026-08-15T22:55:46.343551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.321518Z","title":"Measuring Massive Multitask Language Understanding.Proceedings of the International Conference on Learn- ing Representations (ICLR), 2021","venue":null,"work_id":"296d3382-7276-44db-835d-e7b6434bd77d","year":2021},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.953447Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:b2e7f0473e2c98945cc583b975a8f8ec6b9ba9dd3e80d719a6d02aedbe051c85","observation_id":"fbb2e76e-b153-49db-be2d-cb1cb68e88d6","resolution":{"observed_at":"2026-08-15T22:55:46.326789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.304934Z","title":"The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants","venue":null,"work_id":"b5c95d18-e569-4700-8978-39717a741f43","year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.957960Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:cb5857abcffe05bea7485a18389a94cd4f634db3054d6ce5d1170cb7acb46561","observation_id":"7904a22f-f143-410a-817a-d1ecd5b43ba1","resolution":{"observed_at":"2026-08-15T22:55:46.310535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T22:55:45.962563Z","title":"Training Verifiers to Solve Math Word Problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.962563Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:d795a290d5637aa04f19f36425567f0e7fcbdca394ee6c7550990833caf9bb86","observation_id":"3a1c596b-a8d1-4605-ab35-95297da8aa0b","resolution":{"observed_at":"2026-08-15T22:55:45.962563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.289652Z","title":"HellaSwag: Can a Machine Re- ally Finish Your Sentence? InProceedings of the 57th Annual Meeting of the Association for Computational Linguistics, 2019","venue":null,"work_id":"9806e3a4-5ab7-461a-a223-ec88f9446a56","year":2019},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.968043Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:13ac45246636fbbe52b5c10846c89ca53fc53ed04ae816f8c358dcc675fa8e7a","observation_id":"2607462f-48a4-4ab3-935d-56a9f8e7245b","resolution":{"observed_at":"2026-08-15T22:55:46.294473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-15T22:55:45.972656Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge.arXiv:1803.05457v1, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.972656Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:a963423e27e706efd8849ec2c9981f13eb18236e4d5bdcffe8808cf2a1374053","observation_id":"f34f9659-586c-4152-97fc-962a851e78f1","resolution":{"observed_at":"2026-08-15T22:55:45.972656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.273958Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods, 2021","venue":null,"work_id":"582129f9-00f9-47a8-bb89-1bb88286732e","year":2021},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.977471Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:10a5e07e17c7760325500b4bdf8293a1b74423c30276605e9227a66e03ca377c","observation_id":"2e8c0c0b-6045-4134-8be8-5dacd86a329c","resolution":{"observed_at":"2026-08-15T22:55:46.278949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.257815Z","title":"WinoGrande: An Adversarial Wino- grad Schema Challenge at Scale","venue":null,"work_id":"29d43dc2-39d4-47e4-a552-e08108af4c16","year":2019},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.982134Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:c127d3222b33e32bc4837929029679cd4cbc29757e3759d228225097b010a14a","observation_id":"2452316c-e0b8-44e1-8dbd-b9851b774e45","resolution":{"observed_at":"2026-08-15T22:55:46.263222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.242633Z","title":"Fine-tuned","venue":null,"work_id":"c2efc896-23ce-4c0d-a5d4-775ed5f85986","year":2023},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.986790Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:3f191e8bf3b3ccc6a85723a062b1e55e0b4e53d77517cde5333df28cb17ab6a1","observation_id":"0f505a17-c735-41c2-9ee5-498617789b14","resolution":{"observed_at":"2026-08-15T22:55:46.247316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T05:29:11.556586Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 2 inbound Pith citation observations for arXiv:2505.05946."}