{"as_of":"2026-08-11T05:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:146f383dd4f852868e58ae04d0a70f1898428b827be2a086e2e24e5ce17fc5a7","coverage":[{"denominator":129,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T12:11:16.326752Z","state":"measured"},{"denominator":200,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":200,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":816,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:18:48.617927Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":134,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"reference_index":142,"source":"pdf_text","source_observed_at":"2026-05-10T22:46:39.268353Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2303.18223"},"observation_digest":"sha256:f9a81a74645b1087e2be5f550a97a2e73e873f8700d6a706540f222bb17bf19c","observation_id":"1e244709-815a-4d1f-8481-8b604cab05a1","resolution":{"observed_at":"2026-05-10T22:46:40.648135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2402.06922","last_updated":"2026-04-21T14:06:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-10T11:07:24Z","title":"Whispers in the Machine: Confidentiality in Agentic Systems","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-24T03:59:03.972043Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2402.06922"},"observation_digest":"sha256:45781a32ee47471bba9a81e1971b1c22cf68d24dc2b6dbe6556fa63e374a5cc9","observation_id":"32ff83e4-f78f-4e18-b19d-c9980754225b","resolution":{"observed_at":"2026-05-24T04:03:53.838129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2405.02079","last_updated":"2025-04-18T11:20:24Z","snapshot_observed_at":"2026-08-03T06:11:43.529044Z","submitted_at":"2024-05-03T13:12:28Z","title":"Argumentative Large Language Models for Explainable and Contestable Claim Verification","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-24T01:17:26.111194Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2405.02079"},"observation_digest":"sha256:5477f6490c6680e6fca1066483cf685448b099041aac3b639a3a37ed67054b32","observation_id":"2a6127cd-66ca-4201-ae5b-b5735270d8ec","resolution":{"observed_at":"2026-05-24T01:18:42.209834Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-08-07T08:11:20.950548Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T12:06:13.697487Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2405.14573"},"observation_digest":"sha256:74ab3ad5a63b9b9a08b727b60a6d46eac7b6bae698b74f4bd2de75f9352d7cab","observation_id":"e745bd77-8f14-4197-a6ef-c329e9535ec7","resolution":{"observed_at":"2026-05-13T12:06:13.825027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T20:53:45.878221Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2406.06592"},"observation_digest":"sha256:5ead16ac789e8186b7200fc97e0da01f2b6eaa51f7878e394579a60abf9587b1","observation_id":"174e6b17-e5fa-4ebd-9a14-255faddb1d9f","resolution":{"observed_at":"2026-05-13T20:53:45.911301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"reference_index":140,"source":"arxiv_source","source_observed_at":"2026-05-16T06:58:36.684583Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2406.08464"},"observation_digest":"sha256:9bcef77eb8ef76756d8933b9016810f114e7843bc70f5709f70af92ea0f817d9","observation_id":"8be4f0bc-3d69-4ada-83d2-2aa6aaa2e597","resolution":{"observed_at":"2026-05-16T06:58:36.891851Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T04:48:26.303240Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2406.19314"},"observation_digest":"sha256:5bc8fe345cf01cca29cb6b95be29f7a00239bf7f12ae2a16cb645f72eba649a0","observation_id":"be02f13a-0d02-4ccc-8732-5e2257b9a07e","resolution":{"observed_at":"2026-05-15T04:48:26.505807Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2408.15549","last_updated":"2026-04-17T16:47:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-28T05:53:46Z","title":"WildFeedback: Aligning LLMs With In-situ User Interactions And Feedback","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-23T22:37:43.230753Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2408.15549"},"observation_digest":"sha256:941da85d5f60c70a69b62737667ddbe034c7cc8f9c7defaa03e08c4167474535","observation_id":"6f93f34a-0329-433a-a1f0-1ce32328b691","resolution":{"observed_at":"2026-05-23T22:38:32.520374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-08-10T21:15:46.437989Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":146,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:4d163ced40ae3b7ec191445db5ab6c406a16ff0842b614b7ea4bc51cf8dc3f93","observation_id":"519611ce-b368-48d8-a7b9-bbbe6d390762","resolution":{"observed_at":"2026-05-23T20:58:26.345381Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.02644","last_updated":"2025-05-30T03:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-03T16:30:47Z","title":"Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents","version":4},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-12T13:36:57.011451Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.02644"},"observation_digest":"sha256:92b0b645488ed239f289657439fe3a191c3b61ad89f144593ccdd35d730a19cf","observation_id":"afe5f978-1f1c-47bf-9ecb-63afa31e2cea","resolution":{"observed_at":"2026-05-12T13:36:57.174673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-15T00:42:11.891829Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.05229"},"observation_digest":"sha256:6660b83a889f1bfeb147abdae57e565b1b1da34499165e034d3cc95486e554ae","observation_id":"ba24866b-1de1-45f4-b234-dd1c535b0a49","resolution":{"observed_at":"2026-05-15T00:42:11.978514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:50.009149Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.10629"},"observation_digest":"sha256:64a6f3682b20b308de3cc3ac4bfc7837a0cf7c9ae3fc37d9e3dc0a294a876a69","observation_id":"d45de892-0290-4721-8029-d3a6fc9a6b2b","resolution":{"observed_at":"2026-05-15T00:56:50.031418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.13846","last_updated":"2026-05-18T05:12:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T17:58:14Z","title":"LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-23T18:31:35.391674Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.13846"},"observation_digest":"sha256:4e07e67ec19470bbdfe1a8d780b71fea8d3275257f1e365938311cd48d721136","observation_id":"4ea583d7-0dae-4766-a84e-17d53136cc03","resolution":{"observed_at":"2026-05-23T18:33:19.559825Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T16:18:01.560780Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2410.18451"},"observation_digest":"sha256:ff9b21e79f5553e12e6ed18a8bc300a0ee2ada62e733353170a8aa31f7b2bd25","observation_id":"994b1759-f09d-451f-8f87-d9fe39ce35dc","resolution":{"observed_at":"2026-05-17T16:18:01.667248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T09:15:07.523565Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.03555"},"observation_digest":"sha256:8e86ecf3e8155371b58a787737276d8a90557153096102673e9792f46897dc45","observation_id":"a63164f1-15cd-445f-aaa1-fafc0f7b91f4","resolution":{"observed_at":"2026-05-15T09:15:07.579671Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.05496","last_updated":"2024-12-07T01:46:38Z","snapshot_observed_at":"2026-08-07T15:28:16.662668Z","submitted_at":"2024-12-07T01:46:38Z","title":"Flex Attention: A Programming Model for Generating Optimized Attention Kernels","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-17T21:27:16.615071Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.05496"},"observation_digest":"sha256:ef429d9cbf59aec256a46c221b73213645b5900001ae9789a0ef2bbf68d15841","observation_id":"5303309a-0270-4245-a092-956238fd9312","resolution":{"observed_at":"2026-05-17T21:27:16.688665Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:e64cc873b1d5b29e62ae879f95dd3bebce4ad6e4dd13f6425f0162cfd960d51c","observation_id":"bcc50f09-23f8-4a6a-b9fa-82ed72d81297","resolution":{"observed_at":"2026-05-20T17:46:47.077697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-23T06:25:00.376073Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.15115"},"observation_digest":"sha256:a5014151ad64cd8a64896c6bac234985156abc1e18044cb73e2d36e26e2c6289","observation_id":"9e27ef05-20e7-47ae-badf-b49b21286739","resolution":{"observed_at":"2026-05-23T06:25:27.909331Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T05:18:48.617927Z","title":"Riviere, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17747","last_updated":"2024-12-23T18:02:25Z","snapshot_observed_at":"2026-08-11T05:11:11.986899Z","submitted_at":"2024-12-23T18:02:25Z","title":"Deliberation in Latent Space via Differentiable Cache Augmentation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T05:18:48.617927Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.17747"},"observation_digest":"sha256:935b3efdadfae8bd22dca426a81489a016c2ac7bfc928f5f5d79d7dc3a0335e7","observation_id":"180cfbd5-ce5d-477c-b3e6-08d03bc283fd","resolution":{"observed_at":"2026-08-11T05:18:48.617927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T05:13:07.220486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17758","last_updated":"2024-12-23T18:14:36Z","snapshot_observed_at":"2026-08-11T05:07:23.606679Z","submitted_at":"2024-12-23T18:14:36Z","title":"In Case You Missed It: ARC 'Challenge' Is Not That Challenging","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T05:13:07.220486Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.17758"},"observation_digest":"sha256:8612900ed35c6c3b54b810c3c8c45e8af682b9b8cd734772e706406588d91edb","observation_id":"83b4a24b-e473-42c2-b3f9-527675c20582","resolution":{"observed_at":"2026-08-11T05:13:07.220486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T12:36:50.060335Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.18925"},"observation_digest":"sha256:c7b905622a1723cd86c799232d0e7b79a5134fe5f1fc841fbf174dd211241c47","observation_id":"563eb4e9-1047-4771-a3c1-b4a00bbdfa69","resolution":{"observed_at":"2026-05-15T12:36:50.299311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T01:05:19.064410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19031","last_updated":"2024-12-26T03:01:32Z","snapshot_observed_at":"2026-08-11T00:55:28.795147Z","submitted_at":"2024-12-26T03:01:32Z","title":"Repository Structure-Aware Training Makes SLMs Better Issue Resolver","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T01:05:19.064410Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.19031"},"observation_digest":"sha256:4573677bcc004a3110cfced70ec549de1d46e71d637af75efe11d43f1de15965","observation_id":"79796cbe-e29e-4ece-baf8-5061bbd3b321","resolution":{"observed_at":"2026-08-11T01:05:19.064410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T23:27:17.068706Z","title":"arXiv:2408.00118","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.20440","last_updated":"2024-12-29T11:33:51Z","snapshot_observed_at":"2026-08-10T23:19:19.654990Z","submitted_at":"2024-12-29T11:33:51Z","title":"Enhancing Entertainment Translation for Indian Languages using Adaptive Context, Style and LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T23:27:17.068706Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.20440"},"observation_digest":"sha256:0721a46622f13c74bd40c60971ebfc9af73be4620d1ac03c3383e7b9027f6bad","observation_id":"8d528392-ad4b-4c2d-ad87-69be09806eab","resolution":{"observed_at":"2026-08-10T23:27:17.068706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T23:09:44.542239Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-08-11T02:39:29.458364Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T23:09:44.542239Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.20993"},"observation_digest":"sha256:adf5cf34a1c08db1feddd20a3cb216e76fd459392312a369d720c39eb59754f4","observation_id":"d098bda8-fcea-49b0-acf7-32111887aa04","resolution":{"observed_at":"2026-08-10T23:09:44.542239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T23:08:27.854625Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.21124","last_updated":"2025-03-16T21:10:15Z","snapshot_observed_at":"2026-08-11T00:26:48.735937Z","submitted_at":"2024-12-30T17:55:28Z","title":"Adaptive Batch Size Schedules for Distributed Training of Language Models with Data and Model Parallelism","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:27.854625Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.21124"},"observation_digest":"sha256:59eba8ff0aa8f602978b47721d080d3a0537229abac38f166f0c38312179b286","observation_id":"cf72c474-a5cb-42c7-9018-3fb9dcfd2392","resolution":{"observed_at":"2026-08-10T23:08:27.854625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T23:40:39.002438Z","title":"Gemma 2: Improving open language models at a practical size,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00055","last_updated":"2024-12-28T07:48:57Z","snapshot_observed_at":"2026-08-10T23:33:11.981274Z","submitted_at":"2024-12-28T07:48:57Z","title":"LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T23:40:39.002438Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.00055"},"observation_digest":"sha256:20cf176ef0ba436030d367a9c38d4c2c2dd9aee852174a607ae6d384ec6c351e","observation_id":"c544bbfe-3ab1-47fd-8be2-19fa5ce5bcab","resolution":{"observed_at":"2026-08-10T23:40:39.002438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T23:24:01.460118Z","title":"Gemma 2: Improving open language models at a practical size, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00070","last_updated":"2025-05-02T05:27:38Z","snapshot_observed_at":"2026-08-10T23:15:50.606633Z","submitted_at":"2024-12-29T18:58:09Z","title":"ICLR: In-Context Learning of Representations","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T23:24:01.460118Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.00070"},"observation_digest":"sha256:496a876b5b8a5ad7718214249a37077ddf45c29d5ef837337f8e99faa67e3164","observation_id":"ad727de8-6240-4260-b768-cecf5a44534c","resolution":{"observed_at":"2026-08-10T23:24:01.460118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T22:45:12.230638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00911","last_updated":"2025-01-01T17:58:31Z","snapshot_observed_at":"2026-08-10T22:37:21.538654Z","submitted_at":"2025-01-01T17:58:31Z","title":"Aligning LLMs with Domain Invariant Reward Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T22:45:12.230638Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.00911"},"observation_digest":"sha256:c64d9d050e88eb8a8c352d32fddb819f504e978efe18f77027b8b5d7e0e36e47","observation_id":"0eff83a4-e1f8-4ef7-ba63-5a00b1299d15","resolution":{"observed_at":"2026-08-10T22:45:12.230638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T22:33:24.432488Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01332","last_updated":"2025-01-02T16:34:10Z","snapshot_observed_at":"2026-08-10T22:27:20.970767Z","submitted_at":"2025-01-02T16:34:10Z","title":"Decoding Knowledge in Large Language Models: A Framework for Categorization and Comprehension","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T22:33:24.432488Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.01332"},"observation_digest":"sha256:82a665d3756ed11a1ddd9e81afcd99331a30729683e7233f34cfd7723a1afc90","observation_id":"5b07a238-0830-4e9e-bbe5-c10a06314e6c","resolution":{"observed_at":"2026-08-10T22:33:24.432488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T22:32:55.554140Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01428","last_updated":"2025-03-11T07:54:04Z","snapshot_observed_at":"2026-08-10T22:25:36.091919Z","submitted_at":"2025-01-02T18:59:59Z","title":"GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models","version":4},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:55.554140Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.01428"},"observation_digest":"sha256:7bbebffd7ecc8ccbcf3f3169f34d0d06e234fa02f78ca784d201cd2be6f176e3","observation_id":"6191210e-0085-4853-97cb-978b0b9a6ff0","resolution":{"observed_at":"2026-08-10T22:32:55.554140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T22:25:54.697793Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ramé, A., Ferret, J., Liu, P., Tafti, P., Friesen, A., Casbon, M., Ramos, S., Kumar, R., Lan, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01830","last_updated":"2025-01-03T14:30:14Z","snapshot_observed_at":"2026-08-11T03:10:45.471743Z","submitted_at":"2025-01-03T14:30:14Z","title":"Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T22:25:54.697793Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.01830"},"observation_digest":"sha256:21ec52f7361f77be44b152cedae8f629d7d85ddcf8d3fbb5c754bc950b52fafa","observation_id":"b2569346-1b70-414f-878c-29b61a9617cc","resolution":{"observed_at":"2026-08-10T22:25:54.697793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T22:03:26.074529Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.03012","last_updated":"2025-08-13T13:42:57Z","snapshot_observed_at":"2026-08-11T03:14:04.497536Z","submitted_at":"2025-01-06T13:37:13Z","title":"Analyzing Finetuning Representation Shift for Multimodal LLMs Steering","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T22:03:26.074529Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.03012"},"observation_digest":"sha256:8c84f388104e4b06547880456775fdbf0a789fe05242f37885b3ff63ba9825fb","observation_id":"7271aa5e-4950-474d-8bc5-b996ac10cd3d","resolution":{"observed_at":"2026-08-10T22:03:26.074529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:c90066528f835c0f82ea58481d2ec543b342cf98d8e8a10a67f8b69d5296136a","observation_id":"71174748-c800-4fce-995c-7efa3502db26","resolution":{"observed_at":"2026-05-10T23:38:45.943689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T21:51:08.893626Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ramé, A., Ferret, J., Liu, P., Tafti, P., Friesen, A., Casbon, M., Ramos, S., Kumar, R., Lan, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03884","last_updated":"2025-05-30T04:56:02Z","snapshot_observed_at":"2026-08-10T21:42:50.557321Z","submitted_at":"2025-01-07T15:46:42Z","title":"AlphaPO: Reward Shape Matters for LLM Alignment","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T21:51:08.893626Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.03884"},"observation_digest":"sha256:1ac877c814835de8992ad1f029a1e04585ae803916e81dd5f51102f9d66c8367","observation_id":"9da61e68-432b-4e4d-a6b7-6aaaaa25455e","resolution":{"observed_at":"2026-08-10T21:51:08.893626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T21:47:08.908010Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03952","last_updated":"2025-01-07T17:24:17Z","snapshot_observed_at":"2026-08-10T21:41:18.407742Z","submitted_at":"2025-01-07T17:24:17Z","title":"Localizing AI: Evaluating Open-Weight Language Models for Languages of Baltic States","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T21:47:08.908010Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.03952"},"observation_digest":"sha256:9e112b7606fcb646df22577ab306b5a6f4f70641a03c79ff11f31407c0c5b0a8","observation_id":"49b9e03f-1e4a-4e97-8d42-711c89881f5a","resolution":{"observed_at":"2026-08-10T21:47:08.908010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T21:45:55.367568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.367568Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:89d40f6284d3ea22326a341232e01ac687158ce0ed422fb86f8c0f5ee63d0ad7","observation_id":"70da037e-6b04-43f2-8887-60240f1d9332","resolution":{"observed_at":"2026-08-10T21:45:55.367568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T21:28:19.063756Z","title":"Gemma 2: Improving open language models at a practical size,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04858","last_updated":"2025-01-08T22:16:40Z","snapshot_observed_at":"2026-08-10T21:21:35.599416Z","submitted_at":"2025-01-08T22:16:40Z","title":"Advancing Retrieval-Augmented Generation for Persian: Development of Language Models, Comprehensive Benchmarks, and Best Practices for Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:28:19.063756Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.04858"},"observation_digest":"sha256:59c74131db167a353da4d461c58fcc3f0e3d62f5b04928d9fbd34e42e9be83b9","observation_id":"79d70ddf-ca72-4738-bd72-a3026f0d50e3","resolution":{"observed_at":"2026-08-10T21:28:19.063756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T21:18:05.224687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05255","last_updated":"2025-04-24T15:43:32Z","snapshot_observed_at":"2026-08-10T22:37:05.215083Z","submitted_at":"2025-01-09T14:12:43Z","title":"CallNavi, A Challenge and Empirical Study on LLM Function Calling and Routing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:05.224687Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.05255"},"observation_digest":"sha256:1b309f6dd965f4fc05a56b7686d6c175929891ca1e9b5aed3e21833444b805c6","observation_id":"24695f1f-7f38-439b-a429-7307bbe21eb8","resolution":{"observed_at":"2026-08-10T21:18:05.224687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T21:15:54.834592Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05497","last_updated":"2025-01-09T17:20:00Z","snapshot_observed_at":"2026-08-10T21:10:48.091179Z","submitted_at":"2025-01-09T17:20:00Z","title":"Spatial Information Integration in Small Language Models for Document Layout Generation and Classification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T21:15:54.834592Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.05497"},"observation_digest":"sha256:86ac41c2dfd6b1eae837abdaf57523145bb12a8ebd74ca67901f71f44565997d","observation_id":"83a6e153-56c3-4e74-84c6-68c30f3df22f","resolution":{"observed_at":"2026-08-10T21:15:54.834592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T20:54:01.377192Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.06892","last_updated":"2025-05-25T13:20:08Z","snapshot_observed_at":"2026-08-10T20:47:42.095074Z","submitted_at":"2025-01-12T18:02:29Z","title":"Language Fusion for Parameter-Efficient Cross-lingual Transfer","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T20:54:01.377192Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.06892"},"observation_digest":"sha256:26c1b8b647175231fa34d0dd08d86266d4ba41830da081eceb2e1a3b78120799","observation_id":"3a0be4d8-6456-4a8a-86d1-7834542fc8f0","resolution":{"observed_at":"2026-08-10T20:54:01.377192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T20:54:02.437992Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07124","last_updated":"2025-01-17T09:39:17Z","snapshot_observed_at":"2026-08-10T22:14:07.704280Z","submitted_at":"2025-01-13T08:26:43Z","title":"LLM360 K2: Building a 65B 360-Open-Source Large Language Model from Scratch","version":3},"reference_index":131,"source":"arxiv_source","source_observed_at":"2026-08-10T20:54:02.437992Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.07124"},"observation_digest":"sha256:b24898cbc8722b616b9f79a99306f710a0114dd4854281bdf5e8910a61d690c6","observation_id":"4bd56658-c811-4037-937c-fe2166221d8a","resolution":{"observed_at":"2026-08-10T20:54:02.437992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T20:18:58.472360Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08925","last_updated":"2025-08-24T16:04:08Z","snapshot_observed_at":"2026-08-11T00:45:46.949013Z","submitted_at":"2025-01-15T16:30:29Z","title":"Disentangling Exploration of Large Language Models by Optimal Exploitation","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T20:18:58.472360Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.08925"},"observation_digest":"sha256:be1bcc1ad9e0916f4e1290e666d224e9fcc9b88e60be4fb7b0d53a66ab536278","observation_id":"3742c7b5-f72c-4136-8590-d617fffcaaa3","resolution":{"observed_at":"2026-08-10T20:18:58.472360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T20:15:54.832514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09004","last_updated":"2025-01-15T18:37:08Z","snapshot_observed_at":"2026-08-10T20:10:03.397581Z","submitted_at":"2025-01-15T18:37:08Z","title":"Aegis2.0: A Diverse AI Safety Dataset and Risks Taxonomy for Alignment of LLM Guardrails","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T20:15:54.832514Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.09004"},"observation_digest":"sha256:7234c0bd8281973831a2c17b47a1fb9785dbc12c7f0190458d65ca9d3f45c848","observation_id":"8fac5e1e-6aeb-4c21-bddb-aa486eafa7d8","resolution":{"observed_at":"2026-08-10T20:15:54.832514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T20:14:59.303518Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09223","last_updated":"2025-06-15T13:24:11Z","snapshot_observed_at":"2026-08-10T20:07:27.554415Z","submitted_at":"2025-01-16T01:03:56Z","title":"Foundations of Large Language Models","version":2},"reference_index":240,"source":"arxiv_source","source_observed_at":"2026-08-10T20:14:59.303518Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.09223"},"observation_digest":"sha256:3ab42491c8e09bee160d19377c6a3f51f8557d8327a5d13d1ca05537b0189f74","observation_id":"410aceab-53e0-4683-a3a4-8e96116d51f6","resolution":{"observed_at":"2026-08-10T20:14:59.303518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T19:34:26.939993Z","title":"doi: 10.18653/v1/2024.acl-long.828","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09929","last_updated":"2025-04-02T13:20:40Z","snapshot_observed_at":"2026-08-10T19:28:48.617503Z","submitted_at":"2025-01-17T02:55:23Z","title":"Interpretable Steering of Large Language Models with Feature Guided Activation Additions","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:26.939993Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.09929"},"observation_digest":"sha256:97f2725e454f658405b3a4ff7a26b50137acae76d63c70f2a2c06af919aa58d1","observation_id":"46f99a6f-72eb-473b-b2d3-27b888fcaef2","resolution":{"observed_at":"2026-08-10T19:34:26.939993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T19:34:26.944662Z","title":"Adam Scherlis, Kshitij Sachan, Adam S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09929","last_updated":"2025-04-02T13:20:40Z","snapshot_observed_at":"2026-08-10T19:28:48.617503Z","submitted_at":"2025-01-17T02:55:23Z","title":"Interpretable Steering of Large Language Models with Feature Guided Activation Additions","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:34:26.944662Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.09929"},"observation_digest":"sha256:719db8ed3d1a9c0f453149d51069b89c59a25f52c3fd9567c91b6da6dbc26c41","observation_id":"e2217090-5ff5-4b2b-80c3-0152c913626c","resolution":{"observed_at":"2026-08-10T19:34:26.944662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T18:48:02.438233Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11012","last_updated":"2025-02-22T12:49:12Z","snapshot_observed_at":"2026-08-10T22:12:14.684751Z","submitted_at":"2025-01-19T11:11:55Z","title":"GenAI Content Detection Task 1: English and Multilingual Machine-Generated Text Detection: AI vs. Human","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T18:48:02.438233Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.11012"},"observation_digest":"sha256:7ce78d454ade373db6288565f0a8b68ed4350f1f775f6e5ee778439d39463a41","observation_id":"ca796584-924f-4048-9852-9f84e0a6ac66","resolution":{"observed_at":"2026-08-10T18:48:02.438233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T17:44:49.184652Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11953","last_updated":"2025-01-21T07:54:22Z","snapshot_observed_at":"2026-08-10T17:37:56.371362Z","submitted_at":"2025-01-21T07:54:22Z","title":"Proverbs Run in Pairs: Evaluating Proverb Translation Capability of Large Language Model","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T17:44:49.184652Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.11953"},"observation_digest":"sha256:bc33aebe3b7a44ce2a5341fd4e98f8b32969abb6daf1ce0e89ebf3e416fe64bc","observation_id":"f0ca23a5-d5e1-4f58-bb07-000b918289a3","resolution":{"observed_at":"2026-08-10T17:44:49.184652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T16:59:01.411181Z","title":"Gemma 2: Im- proving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12689","last_updated":"2025-09-04T06:20:55Z","snapshot_observed_at":"2026-08-10T16:51:34.188333Z","submitted_at":"2025-01-22T07:52:38Z","title":"IC-Cache: Efficient Large Language Model Serving via In-context Caching","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T16:59:01.411181Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.12689"},"observation_digest":"sha256:f180d16ddd168cedc6dc8568623e1408553d1c1ce983290cd05adec20a492608","observation_id":"95cd782d-7f5b-481f-8aa0-a38814cc11e8","resolution":{"observed_at":"2026-08-10T16:59:01.411181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T16:16:52.645062Z","title":"arXiv preprint arXiv:2408.00118 (2024) 4, 5","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13381","last_updated":"2025-02-11T12:44:39Z","snapshot_observed_at":"2026-08-10T17:36:19.095063Z","submitted_at":"2025-01-23T04:50:03Z","title":"Do as We Do, Not as You Think: the Conformity of Large Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T16:16:52.645062Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.13381"},"observation_digest":"sha256:9bc48ade168c7bb30032411728826acc5f5f588bdca4aebb9e5bb6a9c61c47f4","observation_id":"0551bd6b-907d-4173-98a8-b25bc7126889","resolution":{"observed_at":"2026-08-10T16:16:52.645062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T16:17:33.756494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13391","last_updated":"2025-01-23T05:24:18Z","snapshot_observed_at":"2026-08-10T16:36:49.941970Z","submitted_at":"2025-01-23T05:24:18Z","title":"Can Large Language Models Understand Preferences in Personalized Recommendation?","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T16:17:33.756494Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.13391"},"observation_digest":"sha256:cec500bc2726ebddec9b12d4e6bcf6d0cba0d517250ca50adf99d171c9c01dc8","observation_id":"ee24a763-d025-4a60-a6f1-8ca22424aa3c","resolution":{"observed_at":"2026-08-10T16:17:33.756494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T15:49:01.487099Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13620","last_updated":"2025-05-06T13:59:11Z","snapshot_observed_at":"2026-08-11T03:36:38.052223Z","submitted_at":"2025-01-23T12:42:42Z","title":"A Cognitive Paradigm Approach to Probe the Perception-Reasoning Interface in VLMs","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T15:49:01.487099Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.13620"},"observation_digest":"sha256:d76a9edabaa5a54faeb3ca69577ae6b7a655e5663c55924b60b11770f1bec583","observation_id":"03cf82ac-e301-4138-827f-ab3f191d06ca","resolution":{"observed_at":"2026-08-10T15:49:01.487099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T15:31:10.758349Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13912","last_updated":"2025-01-23T18:49:33Z","snapshot_observed_at":"2026-08-10T15:26:33.584062Z","submitted_at":"2025-01-23T18:49:33Z","title":"Analysis of Indic Language Capabilities in LLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T15:31:10.758349Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.13912"},"observation_digest":"sha256:e4da1161b1ea42f7780938a89cb46ea73ab90d84ef06f55ade5880ea203c95dc","observation_id":"6c3e7bd8-1862-46ce-a954-3b37a6c7d05f","resolution":{"observed_at":"2026-08-10T15:31:10.758349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T19:05:53.686432Z","title":"et al (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13944","last_updated":"2025-01-18T05:35:32Z","snapshot_observed_at":"2026-08-10T18:59:34.347853Z","submitted_at":"2025-01-18T05:35:32Z","title":"Fanar: An Arabic-Centric Multimodal Generative AI Platform","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:05:53.686432Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.13944"},"observation_digest":"sha256:e3f0892bf094ea9eaf2cdcf2663474347622c5da920e2559c2f57954a50c523e","observation_id":"24831017-9e1b-443e-8810-b2c1f0bb2df9","resolution":{"observed_at":"2026-08-10T19:05:53.686432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T15:08:52.005508Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14499","last_updated":"2025-01-24T13:59:14Z","snapshot_observed_at":"2026-08-10T15:03:42.561051Z","submitted_at":"2025-01-24T13:59:14Z","title":"Automated Assignment Grading with Large Language Models: Insights From a Bioinformatics Course","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:52.005508Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.14499"},"observation_digest":"sha256:acf9e4f20a162e87a77ca435410347e9c9b10c556162d56f934d7581388ad692","observation_id":"bfa5c5e5-bb5d-470a-bdb7-420dbc46000e","resolution":{"observed_at":"2026-08-10T15:08:52.005508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T14:51:43.392421Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14956","last_updated":"2025-05-31T01:44:04Z","snapshot_observed_at":"2026-08-10T16:53:13.415992Z","submitted_at":"2025-01-24T22:44:22Z","title":"ExPerT: Effective and Explainable Evaluation of Personalized Long-Form Text Generation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T14:51:43.392421Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.14956"},"observation_digest":"sha256:dbef514d765c22525899a4ef0c64f2bdfe249d5250127c19956f519bdd97db1e","observation_id":"ca763092-14ae-4a9e-bae1-300a081a2d49","resolution":{"observed_at":"2026-08-10T14:51:43.392421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T14:21:56.958089Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15442","last_updated":"2025-02-11T13:05:36Z","snapshot_observed_at":"2026-08-10T21:41:30.018247Z","submitted_at":"2025-01-26T08:10:13Z","title":"Overview of the Amphion Toolkit (v0.2)","version":2},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-10T14:21:56.958089Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.15442"},"observation_digest":"sha256:a794004df5745aeea97d4885346dce430acbbb5ed5089984253baa59b01d9d74","observation_id":"c1c2735c-cddc-4df0-9c37-349ca14d148e","resolution":{"observed_at":"2026-08-10T14:21:56.958089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T14:03:43.030057Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.030057Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:d8862a4adf7450c26bf02e8316d3bc130a808b25e572fa36ce520232d12346cf","observation_id":"abf0b690-ded1-4422-8822-52cef9d7953a","resolution":{"observed_at":"2026-08-10T14:03:43.030057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2501.16154","last_updated":"2026-04-14T08:15:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-27T15:48:57Z","title":"AdaMCoT: Rethinking Cross-Lingual Factual Reasoning through Adaptive Multilingual Chain-of-Thought","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T04:55:04.067483Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.16154"},"observation_digest":"sha256:ed39829cc72b5db77cf3bf68cd6520482695e232974173ccc94145081fdd7d1e","observation_id":"8ffa63df-206e-4e1b-a0fd-c0f119956d0a","resolution":{"observed_at":"2026-05-23T04:55:24.824604Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T05:35:54.096779Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16937","last_updated":"2025-02-27T23:41:37Z","snapshot_observed_at":"2026-08-10T16:11:46.519970Z","submitted_at":"2025-01-28T13:31:18Z","title":"TAID: Temporally Adaptive Interpolated Distillation for Efficient Knowledge Transfer in Language Models","version":4},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-10T05:35:54.096779Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.16937"},"observation_digest":"sha256:339e4cf8b733749069b2ff8058407ea47632db23d95e085f0ca17e43ea787ec1","observation_id":"08d1517b-8726-45aa-bd62-dc397eb12060","resolution":{"observed_at":"2026-08-10T05:35:54.096779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T13:53:10.939333Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18626","last_updated":"2025-05-31T11:52:11Z","snapshot_observed_at":"2026-08-10T14:20:14.671621Z","submitted_at":"2025-01-27T12:48:47Z","title":"The TIP of the Iceberg: Revealing a Hidden Class of Task-in-Prompt Adversarial Attacks on LLMs","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T13:53:10.939333Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.18626"},"observation_digest":"sha256:251fab60f166d47bc2223a0db62651510ae57a80c4cba666ec84c0eb3c148f99","observation_id":"647a6428-80be-4819-9eba-3a2f173ecdf9","resolution":{"observed_at":"2026-08-10T13:53:10.939333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T22:24:53.893458Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-11T02:09:42.977983Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.893458Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:dc857f26353f0f315d86bb47df6ed77e2618418fab45a6a47305ed1a12150544","observation_id":"ae0c6696-fcc1-4806-8547-36b3c200c9f0","resolution":{"observed_at":"2026-08-09T22:24:53.893458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T22:20:13.826434Z","title":", Riviere, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18858","last_updated":"2025-06-06T18:49:45Z","snapshot_observed_at":"2026-08-09T22:09:26.143585Z","submitted_at":"2025-01-31T02:39:07Z","title":"BRiTE: Bootstrapping Reinforced Thinking Process to Enhance Language Model Reasoning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T22:20:13.826434Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.18858"},"observation_digest":"sha256:6897f3382b8e03ffa63c1f755ce62f60e3624c58d93439f8112de3ea3117ec8d","observation_id":"778fdd76-1f49-48ed-a34c-9bd0cda5bd47","resolution":{"observed_at":"2026-08-09T22:20:13.826434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T22:05:02.563895Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-10T09:04:20.044564Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.563895Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:6e7835d73b78f325b492ee5f8531561c20cf554fbb4a9be1ed5dc28ca9bc5071","observation_id":"4cb2ca6f-924e-4292-a411-ce10f8cc8f47","resolution":{"observed_at":"2026-08-09T22:05:02.563895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T22:03:18.652490Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ramé, A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18922","last_updated":"2025-05-30T08:04:19Z","snapshot_observed_at":"2026-08-10T13:23:44.783119Z","submitted_at":"2025-01-31T06:59:49Z","title":"KBQA-o1: Agentic Knowledge Base Question Answering with Monte Carlo Tree Search","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T22:03:18.652490Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.18922"},"observation_digest":"sha256:875deb80dfdc00d733ed78112a651ab9903d3903dd97078b9f4951b50346d886","observation_id":"e1164f26-b591-410a-83a5-779528ff9941","resolution":{"observed_at":"2026-08-09T22:03:18.652490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T21:55:52.838659Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18972","last_updated":"2025-04-30T03:02:41Z","snapshot_observed_at":"2026-08-09T22:31:57.339880Z","submitted_at":"2025-01-31T09:07:56Z","title":"BCAT: A Block Causal Transformer for PDE Foundation Models for Fluid Dynamics","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T21:55:52.838659Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.18972"},"observation_digest":"sha256:e97e72852c5659575081d24b419372b4486efbf9e048a10b2e8c3d814177cb68","observation_id":"595ea753-b140-4a76-b616-c36d49536aaf","resolution":{"observed_at":"2026-08-09T21:55:52.838659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T20:51:59.213508Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19266","last_updated":"2025-01-31T16:26:28Z","snapshot_observed_at":"2026-08-11T01:59:56.500859Z","submitted_at":"2025-01-31T16:26:28Z","title":"Jackpot! Alignment as a Maximal Lottery","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T20:51:59.213508Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.19266"},"observation_digest":"sha256:32cf0da8d0eb82e021ec741d397ec004a7aa92514e66f7562d0a3cb011ba8cad","observation_id":"185f4e3c-33c4-4a53-8288-faae1a11f075","resolution":{"observed_at":"2026-08-09T20:51:59.213508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T20:51:50.039713Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19287","last_updated":"2025-01-31T16:48:38Z","snapshot_observed_at":"2026-08-10T04:23:33.503634Z","submitted_at":"2025-01-31T16:48:38Z","title":"Differentially Private In-context Learning via Sampling Few-shot Mixed with Zero-shot Outputs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T20:51:50.039713Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.19287"},"observation_digest":"sha256:d0701b05c6ed8a7a5085c178df531f16ce9aecc7fe9dc2e925e86ce6b8186732","observation_id":"b60801c0-2b8d-481a-b3e0-03e70a93dc29","resolution":{"observed_at":"2026-08-09T20:51:50.039713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T20:18:31.188156Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahri- ari, B., Ram ´e, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19406","last_updated":"2025-05-27T06:39:54Z","snapshot_observed_at":"2026-08-09T20:10:52.723666Z","submitted_at":"2025-01-31T18:59:16Z","title":"Low-Rank Adapting Models for Sparse Autoencoders","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T20:18:31.188156Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.19406"},"observation_digest":"sha256:85a0a248ef688f538bdd175e901aa851eaf993756f5f70a98e7f0c6d19e75a49","observation_id":"68fd28ed-bc4b-467c-a545-0ac3cfd1a36f","resolution":{"observed_at":"2026-08-09T20:18:31.188156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T20:29:52.508264Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.508264Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:fbc962bbf213c0df348198081c62442205a22e0c3401975aa0fe2eb6fd1d9ffb","observation_id":"bae4d753-f69b-4c02-9db5-e5baafb8e83b","resolution":{"observed_at":"2026-08-09T20:29:52.508264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T19:32:34.379658Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00306","last_updated":"2025-06-30T16:37:59Z","snapshot_observed_at":"2026-08-10T19:15:16.208697Z","submitted_at":"2025-02-01T04:01:18Z","title":"Riddle Me This! Stealthy Membership Inference for Retrieval-Augmented Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T19:32:34.379658Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.00306"},"observation_digest":"sha256:0a5da67c4a988057e3abbe78e2b969fce5f5b43ca6c3d36336a330ec16b38e5b","observation_id":"2ae5f340-cb2a-492f-9366-5dc23f01f859","resolution":{"observed_at":"2026-08-09T19:32:34.379658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T19:21:22.331855Z","title":"Gemma 2: Improving Open Language Mod- els at a Practical Size, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00372","last_updated":"2025-08-14T12:58:31Z","snapshot_observed_at":"2026-08-10T19:39:25.595837Z","submitted_at":"2025-02-01T09:19:08Z","title":"NAVER: A Neuro-Symbolic Compositional Automaton for Visual Grounding with Explicit Logic Reasoning","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T19:21:22.331855Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.00372"},"observation_digest":"sha256:f73bc8b38d3363a59258ca80327c496c4aa04f5371ad26987e88f3c620856a29","observation_id":"b313a20f-a130-4ece-aa42-1db54810ae0b","resolution":{"observed_at":"2026-08-09T19:21:22.331855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T18:11:28.166006Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-09T18:06:03.044123Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.166006Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:17867032001ae7748e7344cfae049128c9d00a8363695334a8e6e3dd1ca98324","observation_id":"ae457d7c-c095-4333-ad0e-cfc1ebb184a3","resolution":{"observed_at":"2026-08-09T18:11:28.166006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T17:26:11.354087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00894","last_updated":"2025-02-02T20:06:39Z","snapshot_observed_at":"2026-08-09T17:18:47.016847Z","submitted_at":"2025-02-02T20:06:39Z","title":"MorphBPE: A Morpho-Aware Tokenizer Bridging Linguistic Complexity for Efficient LLM Training Across Morphologies","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T17:26:11.354087Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.00894"},"observation_digest":"sha256:b4ed2a6b7247e388fa181b121211b657a698cf34653c5c4ceadc5f67e1cf0d30","observation_id":"615db8bd-fb6c-47f5-a87e-9c53f6c7105b","resolution":{"observed_at":"2026-08-09T17:26:11.354087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T16:14:26.434907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01220","last_updated":"2025-06-23T07:49:40Z","snapshot_observed_at":"2026-08-10T16:38:42.870476Z","submitted_at":"2025-02-03T10:24:55Z","title":"Factual Knowledge in Language Models: Robustness and Anomalies under Simple Temporal Context Variations","version":6},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:26.434907Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.01220"},"observation_digest":"sha256:1ecfabba77a5556b6b006694f843c836f4865935b07da5956ec9ea69aabd37a4","observation_id":"ff6f3c72-eaf9-4710-ab92-4b38deaac6e5","resolution":{"observed_at":"2026-08-09T16:14:26.434907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T16:10:24.914543Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01243","last_updated":"2025-02-03T11:04:51Z","snapshot_observed_at":"2026-08-10T22:40:14.266227Z","submitted_at":"2025-02-03T11:04:51Z","title":"OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T16:10:24.914543Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.01243"},"observation_digest":"sha256:ef3bf1d08eb604de3bed425099d5e2176e9cef0852394a999a3474e19cf32884","observation_id":"63b8aace-8179-418c-a570-6e8ba37b641e","resolution":{"observed_at":"2026-08-09T16:10:24.914543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T15:05:22.577366Z","title":"Association for Computational Lin- guistics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01523","last_updated":"2025-09-10T18:27:02Z","snapshot_observed_at":"2026-08-09T14:59:51.232391Z","submitted_at":"2025-02-03T17:01:51Z","title":"CondAmbigQA: A Benchmark and Dataset for Conditional Ambiguous Question Answering","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T15:05:22.577366Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.01523"},"observation_digest":"sha256:3ba6c5e2c7cc9687489c3c29cb3c68c368bfce6e268d47135bc5c20e60444f23","observation_id":"1f75652a-fd67-4c12-b762-3d6db24c48e0","resolution":{"observed_at":"2026-08-09T15:05:22.577366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T14:27:57.524414Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01804","last_updated":"2025-02-03T20:33:20Z","snapshot_observed_at":"2026-08-10T10:17:54.108594Z","submitted_at":"2025-02-03T20:33:20Z","title":"Soup-of-Experts: Pretraining Specialist Models via Parameters Averaging","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T14:27:57.524414Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.01804"},"observation_digest":"sha256:a2f553458d42d8e0d395d0bd67e044f4ff7a25c754f49c8d9e68cef5cfdab53a","observation_id":"c4d32ccf-b590-4ca8-b125-6fa924230722","resolution":{"observed_at":"2026-08-09T14:27:57.524414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T14:05:14.429018Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01906","last_updated":"2025-08-15T20:46:58Z","snapshot_observed_at":"2026-08-09T13:59:46.182896Z","submitted_at":"2025-02-04T00:46:11Z","title":"D-Attn: Decomposed Attention for Large Vision-and-Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T14:05:14.429018Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.01906"},"observation_digest":"sha256:48a00cc6aa2b5c49d8a7d04f9b095bb7393ee6bea770b583860f1361ff8f70ff","observation_id":"ba9cbdde-fc6f-4357-a5c5-a4c2309de7d8","resolution":{"observed_at":"2026-08-09T14:05:14.429018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T14:03:44.609951Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01926","last_updated":"2025-08-11T14:37:48Z","snapshot_observed_at":"2026-08-09T17:19:03.976853Z","submitted_at":"2025-02-04T01:56:28Z","title":"Fairness through Difference Awareness: Measuring Desired Group Discrimination in LLMs","version":3},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-09T14:03:44.609951Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.01926"},"observation_digest":"sha256:185e5aea91309ba749125e82f45731575d66bf817db0cb3b920d4c8405253160","observation_id":"448019c0-a867-4c6c-b538-4d404fb86768","resolution":{"observed_at":"2026-08-09T14:03:44.609951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T12:08:22.876076Z","title":"G.; Hardin, C.; Bhupatiraju, S.; Hussenot, L.; Mesnard, T.; Shahriari, B.; Ramé, A.; Ferret, J.; Liu, P.; Tafti, P.; Friesen, A.; Casbon, M.; Ramos, S.; Kumar, R.; Lan, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02470","last_updated":"2025-07-25T10:41:54Z","snapshot_observed_at":"2026-08-10T06:26:34.580026Z","submitted_at":"2025-02-04T16:44:38Z","title":"Studying Cross-cluster Modularity in Neural Networks","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T12:08:22.876076Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.02470"},"observation_digest":"sha256:f0172e23ebc5f038f6a7a336ab8a7cc88a5e8bd99305e5e94e47d325ffa9386b","observation_id":"0ab8a989-01ed-4738-8d58-ac97271cf46f","resolution":{"observed_at":"2026-08-09T12:08:22.876076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T12:03:33.561299Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02481","last_updated":"2025-02-24T17:24:04Z","snapshot_observed_at":"2026-08-10T21:54:31.699616Z","submitted_at":"2025-02-04T16:57:03Z","title":"Multilingual Machine Translation with Open Large Language Models at Practical Scale: An Empirical Study","version":4},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T12:03:33.561299Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.02481"},"observation_digest":"sha256:3b1b9a6aa7f71bf90098506b49aac715c652c4ac3dd58ac811e47d6a946de222","observation_id":"0e4a447a-d446-4e3b-9405-c558532f2a0a","resolution":{"observed_at":"2026-08-09T12:03:33.561299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T11:34:57.156496Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram ´e, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-10T14:27:35.164995Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.156496Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:2362f9e9ac280979df4ab90fb8f76a48b6102006adda5d2b255d80bbcfcc85cd","observation_id":"742b1719-657f-4cad-91f1-eb939d2eaeec","resolution":{"observed_at":"2026-08-09T11:34:57.156496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T11:23:40.982032Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\' e , A., Ferret, J., Liu, P., Tafti, P., Friesen, A., Casbon, M., Ramos, S., Kumar, R., Lan, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02732","last_updated":"2025-06-06T11:19:11Z","snapshot_observed_at":"2026-08-10T02:04:43.754736Z","submitted_at":"2025-02-04T21:29:47Z","title":"Peri-LN: Revisiting Normalization Layer in the Transformer Architecture","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T11:23:40.982032Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.02732"},"observation_digest":"sha256:ec84c030c18ad8333c0265b21ebadd351ebe99f9e2f1b0c08867e6a42a2f7272","observation_id":"8b1e79a5-d6b3-4751-9ea3-df53f9195c07","resolution":{"observed_at":"2026-08-09T11:23:40.982032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-10T04:07:56.506438Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"reference_index":228,"source":"arxiv_source","source_observed_at":"2026-05-13T17:30:02.803757Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.02737"},"observation_digest":"sha256:d84be82c2dae94003d707e140a4578cf3a6c5b5eec7091bffc018bf58de0f87c","observation_id":"4a659738-1bd8-4d72-a3f3-287ef606fce2","resolution":{"observed_at":"2026-05-13T17:30:03.034288Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T10:11:51.712221Z","title":"Gemma 2: Improving open language models at a practical size, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03032","last_updated":"2025-07-24T21:16:27Z","snapshot_observed_at":"2026-08-10T02:30:42.809107Z","submitted_at":"2025-02-05T09:39:34Z","title":"Analyze Feature Flow to Enhance Interpretation and Steering in Language Models","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T10:11:51.712221Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.03032"},"observation_digest":"sha256:3f090ed11fae52aac850212fbf146591ac6215b684a1df853b24bbf28801451f","observation_id":"2e7c6fd6-46b2-4f10-8fc0-fe92a225119f","resolution":{"observed_at":"2026-08-09T10:11:51.712221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T23:50:36.149051Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04040","last_updated":"2025-05-30T09:43:42Z","snapshot_observed_at":"2026-08-10T18:19:42.295295Z","submitted_at":"2025-02-06T13:01:44Z","title":"Safety Reasoning with Guidelines","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T23:50:36.149051Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.04040"},"observation_digest":"sha256:26024a6783b2efc27f2bd2039969e9f42a645ff0f981c663e81cb43f5d5752cd","observation_id":"7670e05a-36e8-4b5d-9cf6-c6d76ff827f1","resolution":{"observed_at":"2026-08-08T23:50:36.149051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T21:12:13.874504Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04878","last_updated":"2025-02-07T12:33:08Z","snapshot_observed_at":"2026-08-10T11:45:33.745155Z","submitted_at":"2025-02-07T12:33:08Z","title":"Sparse Autoencoders Do Not Find Canonical Units of Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:13.874504Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.04878"},"observation_digest":"sha256:82b3a2884c9e1ec58b5650a8d9fb35e4c1e6b6d071cf53ff4badc73eeeec02ab","observation_id":"ef503a3c-c93f-4473-9a87-b88950e81bfc","resolution":{"observed_at":"2026-08-08T21:12:13.874504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-05-12T15:39:40.845703Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.05171"},"observation_digest":"sha256:085e5b7055a2e970ca0010a844f20d95990a4b3b36795fef18785f887f663d8b","observation_id":"802d48bd-3a5c-4f5d-93c2-034974f8f8a2","resolution":{"observed_at":"2026-05-12T15:39:41.259913Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T21:06:56.054470Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05242","last_updated":"2026-05-27T09:11:42Z","snapshot_observed_at":"2026-08-08T20:58:31.381100Z","submitted_at":"2025-02-07T13:25:33Z","title":"Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T21:06:56.054470Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.05242"},"observation_digest":"sha256:521a19ea3e7bf07e68a887f2243c3e739c47ff0cb8ccda3ac6ed153e0ecff668","observation_id":"1de0eab6-ba41-4b39-ab5e-adb1a6deb80d","resolution":{"observed_at":"2026-08-08T21:06:56.054470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T19:28:43.601752Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05431","last_updated":"2025-02-12T13:54:01Z","snapshot_observed_at":"2026-08-10T09:14:50.885214Z","submitted_at":"2025-02-08T03:41:16Z","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T19:28:43.601752Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.05431"},"observation_digest":"sha256:c7247345451c4364e9801537520821fcd6613dd7ec85f2b1f77710f10a04894a","observation_id":"f1464f1d-834b-42ec-84ee-843dc87b1a08","resolution":{"observed_at":"2026-08-08T19:28:43.601752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T18:35:11.314974Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05650","last_updated":"2025-02-08T17:51:57Z","snapshot_observed_at":"2026-08-11T03:33:01.969449Z","submitted_at":"2025-02-08T17:51:57Z","title":"Incongruence Identification in Eyewitness Testimony","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T18:35:11.314974Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.05650"},"observation_digest":"sha256:348764702fa661d090f21f0a5c4c697de401a5b7869ba9c90c0d30a398509b91","observation_id":"f659a206-fb5c-4556-8ab5-e567f47bee13","resolution":{"observed_at":"2026-08-08T18:35:11.314974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T18:12:33.453219Z","title":"G., and et al., C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05759","last_updated":"2025-09-07T05:43:06Z","snapshot_observed_at":"2026-08-09T07:10:57.156610Z","submitted_at":"2025-02-09T03:37:06Z","title":"Reinforced Lifelong Editing for Language Models","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T18:12:33.453219Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.05759"},"observation_digest":"sha256:0ab48c5b5c172094a60465d98ea768954a3cd4f7d6eef4b0883b71ccf2f634f9","observation_id":"82cbb669-da32-45f8-9863-d0e0b190af24","resolution":{"observed_at":"2026-08-08T18:12:33.453219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T16:46:58.493887Z","title":"arXiv preprint arXiv:2408.00118","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06115","last_updated":"2025-02-10T02:49:46Z","snapshot_observed_at":"2026-08-10T05:42:20.742109Z","submitted_at":"2025-02-10T02:49:46Z","title":"Task-driven Layerwise Additive Activation Intervention","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T16:46:58.493887Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.06115"},"observation_digest":"sha256:c67b67909fd6137ce46af096d35280818f4a236ac44c59d6790c8f64587ee87c","observation_id":"a831731d-dc79-449f-b280-288fb504611e","resolution":{"observed_at":"2026-08-08T16:46:58.493887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T16:38:28.207949Z","title":"Welty, Christopher A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06147","last_updated":"2025-02-13T05:37:45Z","snapshot_observed_at":"2026-08-11T00:52:55.443176Z","submitted_at":"2025-02-10T04:25:05Z","title":"LegalViz: Legal Text Visualization by Text To Diagram Generation","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T16:38:28.207949Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.06147"},"observation_digest":"sha256:de40112ad9cc8f469c81c483e7b066885f1f6661d6daf059fb6c8899a1143775","observation_id":"23e701f7-b62b-4d3e-92f8-1d48ae211be9","resolution":{"observed_at":"2026-08-08T16:38:28.207949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T15:57:53.716047Z","title":"ArXiv:2408.00118 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06298","last_updated":"2025-02-10T09:40:25Z","snapshot_observed_at":"2026-08-09T02:24:12.712576Z","submitted_at":"2025-02-10T09:40:25Z","title":"SeaExam and SeaBench: Benchmarking LLMs with Local Multilingual Questions in Southeast Asia","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T15:57:53.716047Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.06298"},"observation_digest":"sha256:0470e74314abf61c3a31e26b20b20489119053e06f5a1aa5f3d9f6c20e6a6325","observation_id":"71a1e99b-ab90-4460-a9d6-258414d52ecf","resolution":{"observed_at":"2026-08-08T15:57:53.716047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T14:33:16.021100Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ramé, A., Ferret, J., Liu, P., Tafti, P., Friesen, A., Casbon, M., Ramos, S., Kumar, R., Lan, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06751","last_updated":"2025-05-30T23:27:14Z","snapshot_observed_at":"2026-08-09T17:04:04.288558Z","submitted_at":"2025-02-10T18:26:40Z","title":"What makes a good feedforward computational graph?","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T14:33:16.021100Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.06751"},"observation_digest":"sha256:d4c39ff3abfccda6387e3c72000a2987fede9ba00ef939e6a730dee5a2779a58","observation_id":"b7a0fc2f-f96d-4788-9f24-f83b539e48d2","resolution":{"observed_at":"2026-08-08T14:33:16.021100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T14:26:46.834093Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06782","last_updated":"2025-02-12T10:07:07Z","snapshot_observed_at":"2026-08-08T14:18:27.556352Z","submitted_at":"2025-02-10T18:58:11Z","title":"Lumina-Video: Efficient and Flexible Video Generation with Multi-scale Next-DiT","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-08T14:26:46.834093Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.06782"},"observation_digest":"sha256:b141565096c37e441b01fda75d221d3a3c54df15805b184b1732b7e03f945696","observation_id":"309ada9b-7585-44d7-b7d0-5b063a7e4156","resolution":{"observed_at":"2026-08-08T14:26:46.834093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T14:25:15.953321Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06786","last_updated":"2025-03-03T17:54:53Z","snapshot_observed_at":"2026-08-09T15:54:24.762660Z","submitted_at":"2025-02-10T18:59:10Z","title":"Matryoshka Quantization","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T14:25:15.953321Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.06786"},"observation_digest":"sha256:80a3cc02d1c3e191305f78fc7bc56d2abd118c7c92dc2e4ff87390fea65e3f6a","observation_id":"8901f06c-5dc6-4d80-9152-54d5b006e202","resolution":{"observed_at":"2026-08-08T14:25:15.953321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T20:20:19.724338Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06854","last_updated":"2025-06-05T15:48:54Z","snapshot_observed_at":"2026-08-09T18:06:43.229566Z","submitted_at":"2025-02-07T17:23:48Z","title":"Can Large Language Models Understand Intermediate Representations in Compilers?","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T20:20:19.724338Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.06854"},"observation_digest":"sha256:b348054df8e46e4aa7565b89bc9d44017b37076273556ebe9bb36067a257ba0d","observation_id":"5c8f301e-7f88-44f9-8f4a-a959646760af","resolution":{"observed_at":"2026-08-08T20:20:19.724338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2408.00118/citation-record","integrity":"/paper/2408.00118/integrity","json":"/paper/2408.00118/citation-record.json","paper":"/paper/2408.00118"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agarwal, N","venue":null,"work_id":"a7703167-db43-41f4-a282-4cdc8c584424","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:572af12795e27bec41f9429e9f1225c48161f1e3b4bd381c456e79e0e4bc6766","observation_id":"25af42fc-7c75-4f90-9de3-29da6257dc27","resolution":{"observed_at":"2026-05-10T12:11:16.626406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llama 3 model card","venue":null,"work_id":"008d23c2-07d0-4784-a704-56521d627c6b","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:fb88c0d477a0ff000e209c9f70dacc377e86af2439a8a087258ccabea5890afe","observation_id":"940aec53-6b16-4721-94cb-b835917741a5","resolution":{"observed_at":"2026-05-10T12:11:16.631008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Almazrouei, H","venue":null,"work_id":"29ce5015-6493-4cdb-9d40-83551c1d7058","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:1f9fcd2455bfc726734d05881b1b50b6cc1b58111a9822f84943fcaf02bd9b0c","observation_id":"77e025f9-3c42-4395-a130-43b2a6840998","resolution":{"observed_at":"2026-05-10T12:11:16.633250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Barham, A","venue":null,"work_id":"d3d67d96-f15e-42d9-9361-236a63e80984","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:4e1fb90ff0f8228272078e52ee778c67237c4dffc25a0a5c9ff6bff621702ece","observation_id":"b8fd7b7f-86bf-495b-90f2-8d1d98e9edef","resolution":{"observed_at":"2026-05-10T12:11:16.635172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chiang, L","venue":null,"work_id":"0a2e0bf3-b2de-4c73-9707-690b4d5f6246","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:725ea5d97ddf1ef6b6e5cfeb368a68dec052a5bf557f107b57065dbe06b70895","observation_id":"5b7ea650-c76e-4394-98b5-1d9aea6a1ea7","resolution":{"observed_at":"2026-05-10T12:11:16.637795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini: A family of highly capable multimodal models","venue":null,"work_id":"bda98422-66a3-4bcb-85f2-3dbf8e50bf6a","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:91ba0d2dfad0d0d4b25ad436fb914df7ee4980facc9a2acb30c08b8465a6d584","observation_id":"74fd6fc0-7f9e-4051-8c5f-5f5019460d88","resolution":{"observed_at":"2026-05-10T12:11:16.640031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":"7018963c-e01a-459a-ba15-5dbde07949be","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:5fc82e5c8f1f1bfab93fdf4235937d33b45add9d504e8efc98fa2a48a4c0c8d6","observation_id":"a19e0f6f-49bd-4790-b293-6e0ff125742c","resolution":{"observed_at":"2026-05-10T12:11:16.642378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":"5109c76b-79ad-41dc-8430-6655aefba5ae","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ec6948bba2fa0989d25d0539104f18225a984e62bfad1d3a6a8ada354cdd1a01","observation_id":"7f543331-2f44-42c4-99b1-f67d2d6a9339","resolution":{"observed_at":"2026-05-10T12:11:16.644587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e2402f1a-5097-4258-a4ae-0f83e6cc0a6f","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:423f84e85ac28b927042cf834aa32a9e8755b0f0f10675c5b9febc65c960f6c9","observation_id":"087746ad-ffcd-43d5-a87b-108c99461ded","resolution":{"observed_at":"2026-05-10T12:11:16.646841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fe9e6cdb-6368-4ad0-8937-5d59008218cc","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ee36d71b0902743100ee7cfff157c68cb2eb201b4de5df51d585edd769911aa1","observation_id":"63d14a7a-c3d3-400d-a6bd-429a0c18fd7f","resolution":{"observed_at":"2026-05-10T12:11:16.649062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10524","last_updated":"2024-02-16T09:14:49Z","snapshot_observed_at":"2026-08-11T00:09:23.140130Z","submitted_at":"2024-02-16T09:14:49Z","title":"LLM Comparator: Visual Analytics for Side-by-Side Evaluation of Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.10524","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.10524","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kahng, I","venue":null,"work_id":"1ae1087d-24cb-4fcf-bd3f-99fe17fc7d6e","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2402.10524","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:5ae25060e53d4a000a3e18f4dd2912a7f42a5056db30dc7ee3ee533d3b1a621c","observation_id":"ed8576da-9801-4d39-88fe-af3cddc4cab2","resolution":{"observed_at":"2026-05-10T12:11:16.385993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11671","last_updated":"2024-01-04T18:46:39Z","snapshot_observed_at":"2026-07-06T17:04:54.448866Z","submitted_at":"2023-12-18T19:27:09Z","title":"Evaluating Language-Model Agents on Realistic Autonomous Tasks","version":2},"cited_work":{"arxiv_id":"2312.11671","doi":"10.48550/arxiv.2312.11671","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.11671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating language-model agents on realistic autonomous tasks","venue":"arXiv (Cornell University)","work_id":"7c45ae0e-510a-4bc0-ab18-ca357a0507c2","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2312.11671","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:231b8e28b2d0b729dce3852659256ca6715f7751e4b4839bad330bc1b1a79aa2","observation_id":"616b96ab-7631-4454-8025-141bf720e352","resolution":{"observed_at":"2026-05-10T12:11:16.499532Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:37.750386+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:37.750386+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03315","last_updated":"2024-08-19T20:08:29Z","snapshot_observed_at":"2026-08-04T12:59:01.172921Z","submitted_at":"2024-01-06T22:25:42Z","title":"Malla: Demystifying Real-world Large Language Model Integrated Malicious Services","version":3},"cited_work":{"arxiv_id":"2401.03315","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.03315","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Malla: Demystifying Real-world Large Language Model In- tegrated Malicious Services","venue":null,"work_id":"2782d928-c42d-41b2-a4fb-92dff30193fc","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2401.03315","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:206066cc9f445dc543bb18c42b19a5b86f0d60f9cf9551a839ddf9ec2903cccb","observation_id":"95b9f052-0830-47c2-abb9-c843a7efaaf8","resolution":{"observed_at":"2026-05-10T12:11:16.506166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Personal Communication","venue":null,"work_id":"f5beabdd-64a6-4d50-8898-f7e30a965921","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:cc5f30444898a62a6e5df31298a23680c2b0de472ed511ebdb7f61b473e3a67f","observation_id":"cd13ae36-3683-44b3-ab72-909740377178","resolution":{"observed_at":"2026-05-10T12:11:16.651479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06541","last_updated":"2023-10-21T11:49:09Z","snapshot_observed_at":"2026-08-04T17:34:42.019507Z","submitted_at":"2023-02-13T17:34:13Z","title":"Towards Agile Text Classifiers for Everyone","version":2},"cited_work":{"arxiv_id":"2302.06541","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.06541","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards agile text classifiers for everyone","venue":null,"work_id":"e7b600c9-d820-4577-a448-a958b4884455","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2302.06541","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:126722525ce9c589ddcb842d3579c9468b5b179e0f99b5449d1792ed6ec9f1a1","observation_id":"9d38056d-d606-4828-a1ae-45813202265b","resolution":{"observed_at":"2026-05-10T12:11:16.393672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13793","last_updated":"2024-04-05T12:26:11Z","snapshot_observed_at":"2026-08-07T13:58:15.415231Z","submitted_at":"2024-03-20T17:54:26Z","title":"Evaluating Frontier Models for Dangerous Capabilities","version":2},"cited_work":{"arxiv_id":"2403.13793","doi":"10.48550/arxiv.2403.13793","metadata_source":"pith","pith_arxiv_id":"2403.13793","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating frontier models for dangerous capabilities","venue":"cs.LG","work_id":"2f7df923-9116-4ade-9fca-e78987af4e53","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2403.13793","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:8422d7d2aeb6ba48bc1891992672cd3df01fa0a104b1bdd486be4b24f1011aaa","observation_id":"5e4744a9-9afb-4475-8606-520bfe93d33a","resolution":{"observed_at":"2026-05-10T12:11:16.476742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Radford, J","venue":null,"work_id":"07fb1a81-b55b-4ce5-82a1-fdb30d148e32","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:d66ee455ca03776cb247dab07304a8d04583d8588e33060994810ff28445a1c4","observation_id":"2e09a5af-9844-41f3-af18-4fbffc2ffb2a","resolution":{"observed_at":"2026-05-10T12:11:16.653634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eec7e127-6d0f-4c7c-ac89-f3791c64726b","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:15d61789567e22efb122dcf1d59abf63a92d6828379f824b925ff7f871244217","observation_id":"dcce3ec5-f3a8-45e0-89d0-95753eae523b","resolution":{"observed_at":"2026-05-10T12:11:16.655942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"48ac1f6a-a05f-4771-8e4d-2854f085fc30","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:507ecc72ce4fe82dfbdce6a67d258f6ca4aa1becd26e3bcbead1217c3404cdde","observation_id":"ef240f71-e3b6-4904-a401-3f617529f224","resolution":{"observed_at":"2026-05-10T12:11:16.658225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roberts, H","venue":null,"work_id":"b5a3be0b-26ff-4cd5-80c3-742d6391c955","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:28457d876e8f803f74dc7cadf4f342337fc92511d459f2aff7a854cd86265ade","observation_id":"eb25ba8c-c80e-435f-ab39-804b44e1c2b3","resolution":{"observed_at":"2026-05-10T12:11:16.660715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-08-08T14:17:44.034837Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Model evaluation for extreme risks","venue":"arXiv (Cornell University)","work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:941630b3dbef94d498b6f4ba17a923ba6df65fdae2aae89f18ed8c2459ea1bac","observation_id":"5c16d358-cca0-46ce-8ba2-7bc8d01dac6a","resolution":{"observed_at":"2026-05-10T12:11:16.458916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Suzgun, N","venue":null,"work_id":"690c302c-a2f7-40c5-b7ab-4a709f0e7830","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:3019b1b6c7b27b258612ec80e56111dca65e346305e708b5d3d5b866fb4ce361","observation_id":"1f7755f0-4858-4c1d-a801-bb28689f88d7","resolution":{"observed_at":"2026-05-10T12:11:16.663080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"caed4619-0915-4d65-88fe-e6d213c10833","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9413cdeaaae51680cf0992d23435936fc0a8601a2e11102bfcc3fee05ec19ef1","observation_id":"bf103e76-a33f-4375-ad3d-83506a411e64","resolution":{"observed_at":"2026-05-10T12:11:16.665323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.05122","last_updated":"2020-08-12T06:07:44Z","snapshot_observed_at":"2026-08-02T21:59:17.195799Z","submitted_at":"2020-08-12T06:07:44Z","title":"The Language Interpretability Tool: Extensible, Interactive Visualizations and Analysis for NLP Models","version":1},"cited_work":{"arxiv_id":"2008.05122","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2008.05122","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The language interpretability tool: Extensible, interactive visualiza- tions and analysis for nlp models","venue":null,"work_id":"e3cf7b33-d673-42c4-918a-314e9bb3732f","year":2008},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2008.05122","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:8482493df7930032baaacd480a47ebfbc721c4c3c4682044aa3d22ea90d207f0","observation_id":"1c007b96-6730-4b2b-b2a9-480de912e31d","resolution":{"observed_at":"2026-05-10T12:11:16.502612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Touvron, T","venue":null,"work_id":"52df00ab-8483-4b3a-8cf6-5305694c3ff0","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:7868719c4a786fee3feba31ef02980affa27353446120501f08de03a7bdef812","observation_id":"7b36af60-a665-4225-8289-065b0176f77e","resolution":{"observed_at":"2026-05-10T12:11:16.667830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"grok-1","venue":null,"work_id":"de341b3b-b712-44c7-b124-8afc0b6ea42f","year":2024},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:0da7b4457622af4b7e32a0600226bd53ff719d56909e90bf86012be44ddec3a4","observation_id":"3026e579-659b-4350-ab4f-4aa1f50f81e1","resolution":{"observed_at":"2026-05-10T12:11:16.670352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xla: Optimizing compiler for tensorflow","venue":null,"work_id":"5b913984-7156-44e6-887c-d4371e91a2f2","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:d89ade385bad94e1446526014aa3e4bce51a680cc3b1f9b4f3cd2aa63ff15de4","observation_id":"501919f0-6f56-45ca-8aa4-a89c7f64aecf","resolution":{"observed_at":"2026-05-10T12:11:16.672576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14898","last_updated":"2023-10-30T17:52:18Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:59:50Z","title":"InterCode: Standardizing and Benchmarking Interactive Coding with Execution Feedback","version":3},"cited_work":{"arxiv_id":"2306.14898","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14898","snapshot_observed_at":"2026-06-29T11:23:20.895534Z","title":"Intercode: Standardizing and benchmarking interactive coding with execution feedback","venue":null,"work_id":"1c47eed5-7e6c-49c9-9060-401622d6c1e4","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2306.14898","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:46c0bf8dc017ca9aa5b8316a2926855cbf7efe4d87091c56a7cd9105dda232d9","observation_id":"c7fad0a8-726e-4417-be4f-a7eba076ae48","resolution":{"observed_at":"2026-05-10T12:11:16.397576Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09940","last_updated":"2017-01-12T23:55:36Z","snapshot_observed_at":"2026-07-06T05:20:39.825511Z","submitted_at":"2016-11-29T23:22:39Z","title":"Neural Combinatorial Optimization with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1611.09940","doi":"10.48550/arxiv.1611.09940","metadata_source":"pith","pith_arxiv_id":"1611.09940","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Neural Combinatorial Optimization with Reinforcement Learning","venue":"cs.AI","work_id":"86c3352e-7964-488c-9a6a-22803e1cd602","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1611.09940","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:046607e8b5ed24251e5cabfd1397251342e84dcf2d82eb4c6d694043d4821f2e","observation_id":"8f8a465d-4230-4496-adab-51637e406341","resolution":{"observed_at":"2026-05-10T12:11:16.419147Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Concrete problems in","venue":null,"work_id":"ca2d6b8b-08cd-45d0-82a5-71132dd54f31","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:60aa69aee8ea8f6a8fb1f2f34c4186f42587f238c7f34fde933f3b2ecaf5e465","observation_id":"e16a6ce6-3e52-4788-96cd-56d1c7a9394d","resolution":{"observed_at":"2026-05-10T12:11:16.674897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":"2202.07646","doi":"10.48550/arxiv.2202.07646","metadata_source":"pith","pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantifying Memorization Across Neural Language Models","venue":"cs.LG","work_id":"35487ec1-b90b-4ace-95bd-1bce30064b2e","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:205e220be20af99f62e8535acb71e630af1f76451ef0f5581a0c899a47ddb04d","observation_id":"e81f3096-2659-4f3d-8a00-8a76f9250c16","resolution":{"observed_at":"2026-05-13T22:04:59.782633Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":"2311.17035","doi":"10.48550/arxiv.2311.17035","metadata_source":"pith","pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scalable Extraction of Training Data from (Production) Language Models","venue":"cs.LG","work_id":"7ee4de98-0bdd-47ab-abe6-1865cb65b1ae","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:16b5611c3707a9535beffdf0b9625c1dbc34b4fd7cc5dee0999f3213e70dfa59","observation_id":"38642a91-d54f-4b95-8067-3f1670372518","resolution":{"observed_at":"2026-05-15T19:00:47.082021Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"30th USENIX Security Symposium (USENIX Security 21) , pages=","venue":null,"work_id":"23f94b87-69cd-4613-96c4-8d02e8ad6cce","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:226c707bb83af011490081b15560cbd3c15229068a04252c7532dd298a4cf316","observation_id":"08e5c942-7847-455b-9d33-235a29e29771","resolution":{"observed_at":"2026-05-10T12:11:16.677146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17546","last_updated":"2023-09-11T16:58:48Z","snapshot_observed_at":"2026-08-04T04:34:05.607113Z","submitted_at":"2022-10-31T17:57:55Z","title":"Preventing Verbatim Memorization in Language Models Gives a False Sense of Privacy","version":3},"cited_work":{"arxiv_id":"2210.17546","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.17546","snapshot_observed_at":"2026-07-03T01:27:30.902143Z","title":"Ippolito, F","venue":null,"work_id":"c455adb7-ba4c-4537-827c-98625b5b82c3","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2210.17546","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:216798c27cc49fe5e5f581b1170e2383121384221d354e4d7255e2dfc2b6845a","observation_id":"6957b76d-db48-4436-828b-c07a5542ca39","resolution":{"observed_at":"2026-05-10T12:11:16.492729Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04662","last_updated":"2023-09-09T02:34:01Z","snapshot_observed_at":"2026-08-02T11:19:37.704634Z","submitted_at":"2023-09-09T02:34:01Z","title":"MADLAD-400: A Multilingual And Document-Level Large Audited Dataset","version":1},"cited_work":{"arxiv_id":"2309.04662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04662","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Choquette-Choo, Katherine Lee, Derrick Xin, Aditya Kusupati, Romi Stella, Ankur Bapna, and Orhan Firat","venue":null,"work_id":"5e31eb8d-5d31-4ec4-92d5-0941720097cc","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2309.04662","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:7eaad8a92bbc5042f5e71e1e016eb429caa71b349ad031ddfea00f952404d04f","observation_id":"99d958ca-fe43-46f7-83de-4e36a0fd134c","resolution":{"observed_at":"2026-05-10T12:11:16.495999Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NeurIPS , year =","venue":null,"work_id":"46a9cdba-e406-4559-b6bc-04c08786daf1","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ae20f192f0991385656d33014ad08be6bfc561c2d560fba6c5b9f0c69c0b05f4","observation_id":"a2675556-ffc7-4f0c-a0c3-95e686d48112","resolution":{"observed_at":"2026-05-10T12:11:16.679414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:21:44.431618Z","title":"2023 , eprint=","venue":null,"work_id":"2cfd77f4-17ef-4285-b602-76165f04f2c9","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:42b2ff6ba72f92cdc1c42e15987aa04c33caf54b53fde6a8c5572b0a74e9c01a","observation_id":"32cce3e2-4dd8-4c29-b4d2-cddaca795d93","resolution":{"observed_at":"2026-05-10T12:11:16.681553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T07:40:48.021879Z","title":"2022 , eprint=","venue":null,"work_id":"d058fb05-642a-46e9-92ec-918b9350075a","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:3290ab323c76ba2bd2ed13b086545b0addbfb6d3bf1c2247f1cd7ad8e2064bb1","observation_id":"b0604a0b-6204-444b-9e2c-911b72e14f22","resolution":{"observed_at":"2026-05-10T12:11:16.683587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02136","last_updated":"2018-10-03T07:32:57Z","snapshot_observed_at":"2026-08-02T06:41:33.803920Z","submitted_at":"2016-10-07T04:06:01Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","version":3},"cited_work":{"arxiv_id":"1610.02136","doi":"10.48550/arxiv.1610.02136","metadata_source":"pith","pith_arxiv_id":"1610.02136","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","venue":"cs.NE","work_id":"010332fc-8aad-4ab2-a1de-1ddd0a3c4b7f","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1610.02136","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:63a46f107ea01eac93c1bcd82ed85e420341a3433cafb6565a220e937789dde7","observation_id":"ed18ddde-3f4f-4ac4-9adc-8f908d4b0319","resolution":{"observed_at":"2026-05-12T18:23:45.262282Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:24.594975+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:24.594975+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":"2305.13245","doi":"10.48550/arxiv.2305.13245","metadata_source":"pith","pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","venue":"cs.CL","work_id":"b73ad5b2-e553-4c71-b0c9-67e67ba7b158","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6b36da2d9c596584be3cf849edcb12edb4886c0c8e2713c25569fd89886863f0","observation_id":"0c65bfec-1f31-4e47-a055-e2d26b380999","resolution":{"observed_at":"2026-05-11T06:53:59.644169Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:3db666c978555321253129276e2eca594702f6e8cde9cf43df3a7f34248637ee","observation_id":"b4d8f6dd-a4ad-4c80-b38a-a7c82448d183","resolution":{"observed_at":"2026-05-10T16:01:32.444768Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mastering the game of","venue":null,"work_id":"9fd4a21f-922c-474a-8cbf-44afe2d81f74","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:99c448c658e84faf26cdd0a838969a50d3bba6599c87a31b6325f76ea12fe537","observation_id":"234dfa51-a7ff-42fe-ab4f-ae7bb0399b69","resolution":{"observed_at":"2026-05-10T12:11:16.685601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 50th Annual International Symposium on Computer Architecture , pages=","venue":null,"work_id":"1958d684-f3aa-4731-954a-e374cea35e55","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6089b4e4d05fa88293d5a206f86f11d3352a375d3ea901a599ee17f922d963af","observation_id":"6b2cc0df-d176-4651-b560-178f03f10458","resolution":{"observed_at":"2026-05-10T12:11:16.687905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"d3670003-811e-494e-b001-fa07e671cbf5","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:807b6355b991792c2fb6ea4fa1c68b0abee1b668832f561717b6028711d4009e","observation_id":"9216a802-26ca-4441-97e0-19232b5ac8fb","resolution":{"observed_at":"2026-05-10T12:11:16.690078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":"1911.11641","doi":"10.48550/arxiv.1911.11641","metadata_source":"pith","pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","venue":"cs.CL","work_id":"0d865a62-6376-4606-8d3a-eeb3b6e9ba6d","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:1dd1b1ab85a633d572ff330e477e1d66bc604376dc4970f720e521cb6ea6ace9","observation_id":"e5e358ef-9e8a-44c2-838d-06cc71f0f6ea","resolution":{"observed_at":"2026-05-17T14:55:18.098549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":"1904.09728","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-07-08T01:44:26.198243Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","venue":"cs.CL","work_id":"3f93670e-0ae7-40e5-bed5-74c216638dd1","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:05422bf53d218d0dab221a4402c3cb4a7488e0f202e8582bf94420aefa39ef29","observation_id":"2a476dd5-d428-4429-b743-b6cea75a71b1","resolution":{"observed_at":"2026-05-13T12:22:26.192007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":"1905.10044","doi":"10.48550/arxiv.1905.10044","metadata_source":"pith","pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","venue":"cs.CL","work_id":"511eeb84-4b95-46d5-b14f-50da43f4f19f","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:55db9dc85f69f127ea1ebe70ebc5e6e87efeda337b696d7088c76eb6e4d00feb","observation_id":"51d1d710-4d57-43b1-b640-ea370ab44197","resolution":{"observed_at":"2026-05-13T09:46:19.833273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/tacl_a_00276","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:46:14.494802Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":"Transactions of the Association for Computational Linguistics","work_id":"45551929-96dc-40f3-9f89-10e76731cc24","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:7e5879f45e780c9bb8bec01102a102eda5ee081bcfa0dfdad9d9543bbf2a36a4","observation_id":"cd33e9ad-f1df-4304-8ecf-3fd12fcf32ec","resolution":{"observed_at":"2026-05-10T12:11:16.378030Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-10T22:21:01.890529+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T22:21:01.890529+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:e9e757fffab84ce50005fc6e299e6c2708f98e6d34055ce54fc5645afc9648a9","observation_id":"a6b9bd1f-a060-490d-88fd-d673099d149a","resolution":{"observed_at":"2026-05-10T12:43:44.770948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:0b87ca60d3f971ff6c62fbe9b0ed737a057e0786cbfebb5398c4d98a3ad1a14e","observation_id":"3ff01e58-50d6-45bb-9d85-beb7473494b1","resolution":{"observed_at":"2026-05-10T12:11:16.415038Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:08:02.288369Z","title":null,"venue":null,"work_id":"296b9de5-0258-4b29-832c-3abf245789ad","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:56ac5f1db45033547b33212d59eadf6f87cb300f6bcf7714d697b9e06588cd2b","observation_id":"2c139ecd-9c16-4049-bcbe-3d41618db13d","resolution":{"observed_at":"2026-05-10T12:11:16.692377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6db133b1454cf9a62cc7f1a039160349116a52919b0f5aae0fee6575b7572564","observation_id":"f11d48cd-60fd-4ece-afcb-dda0532df0b5","resolution":{"observed_at":"2026-05-10T12:11:16.422721Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ca3ddad65e34574211e132c2c5bff28107e5402b2500dfd4a14100f060c68c79","observation_id":"46c9fca2-a6cc-4520-8c86-fd288fbaeef1","resolution":{"observed_at":"2026-05-10T12:11:16.429614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:5b9fb86e60e6c66f03fdb94afa8112100f9bebcc469604e584d7fe7cab741c6e","observation_id":"8ead0a5e-f2a5-4a06-a710-bd1cd1e33ed9","resolution":{"observed_at":"2026-05-10T12:11:16.436959Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-07-06T08:09:59.842324Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":"1907.10641","doi":"10.48550/arxiv.1907.10641","metadata_source":"pith","pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","venue":"cs.CL","work_id":"9587a902-54ad-434e-9cbc-bdfe54b5d3bf","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:11d663c5c990a90dde3480ee3a0edcdd108879c7959bb3502276c63bc262ef7e","observation_id":"4ec7bf5b-f300-4454-a399-5dababc0c52e","resolution":{"observed_at":"2026-05-14T17:20:15.117976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06031","last_updated":"2016-06-20T09:37:17Z","snapshot_observed_at":"2026-08-10T23:14:34.195361Z","submitted_at":"2016-06-20T09:37:17Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","version":1},"cited_work":{"arxiv_id":"1606.06031","doi":null,"metadata_source":"pith","pith_arxiv_id":"1606.06031","snapshot_observed_at":"2026-07-10T15:27:20.134743Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","venue":"cs.CL","work_id":"3775e6d1-2f28-4791-82a9-538c0507512c","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1606.06031","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:f13d8a3f5a578e8005513780d64505b61d90b5f61b226711da05987a2979fc75","observation_id":"4241c53f-ef2d-49ff-bdea-a311f0685c4e","resolution":{"observed_at":"2026-05-10T12:11:16.451267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-02T11:13:42.401488Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":"1705.03551","doi":"10.48550/arxiv.1705.03551","metadata_source":"pith","pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","venue":"cs.CL","work_id":"f20e62ba-6265-4b97-aa8c-ddefaf2f5762","year":2017},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a22468da0cb7de943152e07548a03c57d7d2b48da8115dffbd08e85721813e91","observation_id":"67d00269-6d01-4e7d-a3bc-f99b33695569","resolution":{"observed_at":"2026-05-11T15:00:28.883814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:06:27.880303Z","title":"2023 , eprint=","venue":null,"work_id":"8a1e4cb7-b339-4ab3-a5b3-604af3598ddb","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:dedd7bc611d7961633e1ad249262b46471365946901f5e6f867440aa51536397","observation_id":"e41bb05e-6735-4b23-8e76-f7ea69b3bdaf","resolution":{"observed_at":"2026-05-10T12:11:16.694858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:16:24.111187Z","title":"2023 , eprint=","venue":null,"work_id":"329bd184-e5b5-42bc-848f-e4d9af020cd5","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:70ca80f69af254734094c326a5b2e49718d1ccc5a730c7ddb19cc8a1c0871607","observation_id":"e4c9c86c-7620-4902-9d4b-c5b797110018","resolution":{"observed_at":"2026-05-10T12:11:16.697527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:36:29.930966Z","title":"2023 , eprint=","venue":null,"work_id":"8222462c-c885-414a-9965-ea8425278550","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:35115bcfaf71ba4e13571c982da0aae8ddfe8177d7a7d16f75faaf6677480b1d","observation_id":"e815344c-cae3-409f-8948-bd2d638c8ce4","resolution":{"observed_at":"2026-05-10T12:11:16.700054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"fd6f1b62-ff0f-442d-acf4-3e47f159b5f0","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:d76465c84e8a04e2ca2f9eb44ad4e79a8287890b3a4a351465abd7b9bba35989","observation_id":"c90255cd-c6b7-4db0-94d2-9e01d217e070","resolution":{"observed_at":"2026-05-10T12:11:16.702463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":"2309.05463","doi":"10.18653/v1/2025.findings-acl.996","metadata_source":"pith","pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","venue":"cs.CL","work_id":"618db55c-6906-42e3-a4c5-c17088cb1df8","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:7b101726f771274d8a46456660314329d1a48496c996420d184e36287be65448","observation_id":"3317a70f-69f1-4404-b3dd-3070aad4fdf1","resolution":{"observed_at":"2026-05-14T19:18:01.425637Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:deb8329d87eb281349e759d60c000421bd87a413b5bf1ddf2a58581030d3526d","observation_id":"feb83365-ebd2-4eb6-bc8f-2dc51ec62687","resolution":{"observed_at":"2026-05-10T12:11:16.483151Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.3215","last_updated":"2014-12-14T20:59:51Z","snapshot_observed_at":"2026-08-02T03:58:50.109606Z","submitted_at":"2014-09-10T19:55:35Z","title":"Sequence to Sequence Learning with Neural Networks","version":3},"cited_work":{"arxiv_id":"1409.3215","doi":"10.48550/arxiv.1409.3215","metadata_source":"pith","pith_arxiv_id":"1409.3215","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sequence to Sequence Learning with Neural Networks","venue":"cs.CL","work_id":"b32e3d72-9b05-4275-b9a0-0c77d9ac844d","year":2014},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1409.3215","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:76ae43df38b3b470010f3663768be73dcaf80b0c4122c166f3c9516a243ce545","observation_id":"2371c6da-aa0a-4d99-ac42-fbbd2cc85977","resolution":{"observed_at":"2026-05-10T12:11:16.486272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:52:44.965337+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:52:44.965337+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":"1706.03762","doi":"10.1186/s13550-021-00830-6","metadata_source":"pith","pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention Is All You Need","venue":"cs.CL","work_id":"baafb5a2-5272-43bc-932f-09fa9ffe5316","year":2017},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:d5629a78bc3821f4cc1a9b84c6979213ccde69d7799c10bffe55a65aade7bcf9","observation_id":"75292be3-00e0-4f93-9ce1-cc26cae27382","resolution":{"observed_at":"2026-05-10T12:11:16.489289Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:57:47.712205Z","title":"nature , volume=","venue":null,"work_id":"e6b92db6-c2c1-4e28-9c46-8d7bfebba8f1","year":2015},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:53ccdca2a5b3f11c42b51cc535a584d5c968f37de24618754e48eece2b635cd0","observation_id":"f71b5d9c-efbf-4fb5-9381-1f3f873f8010","resolution":{"observed_at":"2026-05-10T12:11:16.705160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"b0c16b33-2a20-4303-b331-85fa5256ae37","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:711b11e9c57826a3ef45d7967770423ed935374603619928f3852ff74716e1e0","observation_id":"198f44cc-ba5b-434f-8c88-8a31bb828f03","resolution":{"observed_at":"2026-05-10T12:11:16.707790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":"88999ab5-c29c-4b93-b7ae-b45bcdfc14f0","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:2fc5c0bb40aada077c0f67eac9ab214038ba8429066162e9788378dfc40d52c4","observation_id":"e44696c4-4014-4b6a-b76c-a7af4e45e443","resolution":{"observed_at":"2026-05-10T12:11:16.710349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2019 , url=","venue":null,"work_id":"3d6c4ae5-24eb-4cda-9462-b5cb8f881348","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:f117b2698c7c7d3452165c914703ca52104d8bca88ee6173f792367d01d0fbcc","observation_id":"257dfda7-7ea3-40d9-926a-3d3db5b3835a","resolution":{"observed_at":"2026-05-10T12:11:16.712763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , publisher=","venue":null,"work_id":"541237ff-eed9-4221-b09b-565a42ab50fd","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9664385c3ae1e41ca4ce7f6089b5fce020997d31e7634c52f28fa179e8897219","observation_id":"045946fa-abc1-4c3d-a135-e297063db154","resolution":{"observed_at":"2026-05-10T12:11:16.715066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large Scale Distributed Deep Networks , url =","venue":null,"work_id":"f3e4ca9a-674a-4a2b-ba50-bf7c7144e5bb","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:3a99a6d49a34d8c704f71419f585648ad5d7e8c58d7187f9dc79f95ea9ac83a0","observation_id":"c6ab2678-e08a-4ddb-b5eb-9ff9e886bf0d","resolution":{"observed_at":"2026-05-10T12:11:16.717524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient Estimation of Word Representations in Vector Space , booktitle =","venue":null,"work_id":"6f76a975-79dc-4f69-866d-5ab6fa4ea53a","year":2013},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6dd4b900f373479b38ac31fd973c102336501d1351356e9eb6fe62bb0c17527b","observation_id":"b8c0c6c3-c0b5-43cb-8af0-a8da0fb63cd1","resolution":{"observed_at":"2026-05-10T12:11:16.720145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":"1810.04805","doi":"10.1111/jofi.12885","metadata_source":"pith","pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","venue":"cs.CL","work_id":"ed240a10-5b19-406c-baa5-30803f465785","year":2018},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:f688998c9f4fba8985b39695b148b6f519fca5415622873a2682bb849c7fc465","observation_id":"e669db9c-bf66-44b3-88ff-dcff7f0cf654","resolution":{"observed_at":"2026-05-10T12:11:16.517446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":"1910.10683","doi":"10.18653/v1/2020.acl-main.259","metadata_source":"pith","pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","venue":"cs.LG","work_id":"50e3b368-0243-4726-8186-233869802ad1","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:60b8fb7cecfe2b05cb5701a5d737ff73eb34c914048473ff7bc5e464db494935","observation_id":"7d5be3e2-0e59-4316-8f60-dcc2b65ba15d","resolution":{"observed_at":"2026-05-12T05:37:56.023799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17189","last_updated":"2022-03-31T17:12:13Z","snapshot_observed_at":"2026-08-10T18:28:25.800458Z","submitted_at":"2022-03-31T17:12:13Z","title":"Scaling Up Models and Data with $\\texttt{t5x}$ and $\\texttt{seqio}$","version":1},"cited_work":{"arxiv_id":"2203.17189","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17189","snapshot_observed_at":"2026-06-30T15:44:48.510903Z","title":"Alexey Romanov and Chaitanya Shivade","venue":null,"work_id":"b4ce3d71-9be2-4401-8618-528a87b188bd","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2203.17189","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:11dfd077f46bf571fc61a417ca5fba65a36e7d2e6ca5403d28cee061849541eb","observation_id":"863817d1-b906-4e25-af65-e89d0c8dbec7","resolution":{"observed_at":"2026-05-10T12:11:16.525059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":"1911.02150","doi":"10.48550/arxiv.1911.02150","metadata_source":"pith","pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","venue":"cs.NE","work_id":"160ea164-b1d4-4adb-8ccb-a4655d8a0bb4","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:70388296df5117bebce3f5ddea01af4d10aa554a1c7733e2e8b19cc0749ebe3d","observation_id":"96dac0aa-9252-4980-89de-3657a4753216","resolution":{"observed_at":"2026-05-10T23:50:20.836519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":"2104.09864","doi":"10.48550/arxiv.2104.09864","metadata_source":"pith","pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","venue":"cs.CL","work_id":"4e5eee26-cd04-4c7a-988f-3e6d1a1f0eb9","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:c52859c45a75bf46b10dc951e5f2daa1c7d4dd1c670e2c487d5b019b69b11f91","observation_id":"1118a66f-ad6c-4cd5-9a95-ac72224fa6a8","resolution":{"observed_at":"2026-05-10T19:37:06.679502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T15:38:39.263809+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:39.263809+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:39.263809+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:22:42.115670Z","title":"2021 USENIX Annual Technical Conference (USENIX ATC 21) , pages=","venue":null,"work_id":"b9317880-19fa-4bbb-b572-777d32d6167d","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:3e24724a03335a43cc62241e1e10efca41eb824b68e4d8215e28b7c312a9d431","observation_id":"c5680e99-aba0-4baf-a167-2580512d86d1","resolution":{"observed_at":"2026-05-10T12:11:16.722776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:72442dd11ee081bd00176b54778f83b2326fc7da5f3589e2aed197165be218f4","observation_id":"767947b1-f978-4e22-9b96-46c61d5c479e","resolution":{"observed_at":"2026-05-10T17:05:01.922266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07467","last_updated":"2019-10-16T16:44:22Z","snapshot_observed_at":"2026-08-08T08:22:25.110228Z","submitted_at":"2019-10-16T16:44:22Z","title":"Root Mean Square Layer Normalization","version":1},"cited_work":{"arxiv_id":"1910.07467","doi":"10.48550/arxiv.1910.07467","metadata_source":"pith","pith_arxiv_id":"1910.07467","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Root Mean Square Layer Normalization","venue":"cs.LG","work_id":"2e813694-442c-4650-ba76-478100469518","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1910.07467","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:b607619e39ad379a68a16325cbdcd12422e03ed94adcbf27616ef6275666be1b","observation_id":"b8ab7f86-36b2-4f57-9c35-11c876d7a3e4","resolution":{"observed_at":"2026-05-17T18:45:27.296410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.06226","last_updated":"2018-08-19T16:49:06Z","snapshot_observed_at":"2026-07-06T06:56:20.935388Z","submitted_at":"2018-08-19T16:49:06Z","title":"SentencePiece: A simple and language independent subword tokenizer and detokenizer for Neural Text Processing","version":1},"cited_work":{"arxiv_id":"1808.06226","doi":"10.18653/v1/d18-2012","metadata_source":"doi_reference","pith_arxiv_id":"1808.06226","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Sentencepiece: A simple and language independent subword tokenizer and detokenizer for neural text processing","venue":"cs.CL","work_id":"81a6320b-c2e1-4d74-a03e-9e1ff6bbed8d","year":2018},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/1808.06226","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6920f114278364e815b25352f6dd2430f61dcc012ce357f7118c045d5204f930","observation_id":"b1b4d602-fcd7-44ac-9cd7-034e4f792c23","resolution":{"observed_at":"2026-05-12T20:09:07.599904Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T12:19:12.876508+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T12:19:12.876508+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04663","last_updated":"2021-12-23T21:29:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-10T20:54:58Z","title":"GSPMD: General and Scalable Parallelization for ML Computation Graphs","version":2},"cited_work":{"arxiv_id":"2105.04663","doi":"10.48550/arxiv.2105.04663","metadata_source":"pith","pith_arxiv_id":"2105.04663","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GSPMD: General and Scalable Parallelization for ML Computation Graphs","venue":"cs.DC","work_id":"0ab74606-fb17-4ead-898b-8086ae8cb3af","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2105.04663","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:22e732c1b0ddc09fea68022decd7e700e27387f5029f16e36227068033e97819","observation_id":"971b8f39-e680-405d-9ff3-9b97ddc8003e","resolution":{"observed_at":"2026-05-18T12:36:36.562059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"a890b0e8-08cb-474b-854c-03f63e2ff049","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:bb09911af6e8e2e510c8da47bf5026e33b5fa615f465dfb860e8cf891fc31c75","observation_id":"5b7ec271-66cb-4db7-8538-b320d6c0a89f","resolution":{"observed_at":"2026-05-10T12:11:16.725155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":"2305.10403","doi":"10.48550/arxiv.2305.10403","metadata_source":"pith","pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaLM 2 Technical Report","venue":"cs.CL","work_id":"905ee9a7-ea61-4a94-bd62-2600cbe3e315","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":115,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:530d421d4f853d81b234be30bcc0041703f92465d677c0d24df3cc4d2b491b9a","observation_id":"22f50c1e-86cb-4c57-83f5-77f39ecadbf5","resolution":{"observed_at":"2026-05-12T11:59:27.667882Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:31:35.375640Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"7763f188-e71e-4330-b7df-6543ef5c2914","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:0e9a20da49723a1579803c7542a73b375ce915e2b214bb6bc35939c89c11fd77","observation_id":"76a1cd65-83a1-40c5-889c-10619749c952","resolution":{"observed_at":"2026-05-10T12:11:16.727822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T15:17:22.153922Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"bd577a47-49ef-4f8a-81ca-86cd88b71479","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:fb044e5fc58083d985962e60ecdfc6b81f5874ef2f8356a0113e5e1e1a4180f9","observation_id":"47a34f2c-d50d-4e4a-8b4c-0ce69a5fa0af","resolution":{"observed_at":"2026-05-10T12:11:16.730458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T15:16:18.951245Z","title":"The method of paired comparisons , author=","venue":null,"work_id":"5feb0654-e8a0-4d93-967e-9878e00988c5","year":1952},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:9c7426422077f2968d48f4763623848497717f821f4cdeb2b40f40d11dafc7cf","observation_id":"0bbf94bf-8abc-406b-9ece-2d5f815cc1d1","resolution":{"observed_at":"2026-05-10T12:11:16.733100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T15:16:18.847440Z","title":"Machine learning , volume=","venue":null,"work_id":"c1d54d34-8857-4268-be1f-002a7c436d05","year":1992},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:d9faa4acf102b8da082f920827b6573fcb1c6e50c3d7d5b61569b3e61c3931d5","observation_id":"5529a37c-d051-4746-8641-4f254c191e95","resolution":{"observed_at":"2026-05-10T12:11:16.735659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T06:40:46.516450Z","title":"2023 , eprint=","venue":null,"work_id":"5a14d1ee-6ab9-4f20-99aa-8dd95900fdab","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:1d49f90e1fb9d7d0b416cd676ab21210343bdd204e4c6fe599e92b5480ee32a2","observation_id":"2516e220-1471-46f9-a1ba-bfed6f3903ed","resolution":{"observed_at":"2026-05-10T12:11:16.738274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:25:58.161975Z","title":"2022 , eprint=","venue":null,"work_id":"57843bfd-d117-4dd9-9b57-8d42a4f2a8ab","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:1e39a77da16d34a97e3f535b2fd220ce78e9c28aab1623161f5a99e60c8443d1","observation_id":"87d20fb2-2fa3-4bcc-a0f7-24eb9dc8ca51","resolution":{"observed_at":"2026-05-10T12:11:16.740993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , eprint=","venue":null,"work_id":"26be9590-f9cb-49ae-b1fd-303eb95375d2","year":2018},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:18e3cc38eee6b003b3772b933ae13d925c621005607df7cd1eca9f895698986a","observation_id":"ea616339-c01a-4e18-8a39-34cf61f7d148","resolution":{"observed_at":"2026-05-10T12:11:16.743427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T20:02:56.622302Z","title":"2016 , eprint=","venue":null,"work_id":"c7b2dda5-4b9d-410c-8ed9-98dbc48cd7cc","year":2016},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:c3364929866373dfc3fd5fe5700fe5f8bd7870fa1438056182821bc22ef732c7","observation_id":"91f88723-cfe3-434f-a6cb-06df568c02fe","resolution":{"observed_at":"2026-05-10T12:11:16.745900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:46:15.077252Z","title":"2019 , eprint=","venue":null,"work_id":"2b686ff3-9be9-434c-bc1f-ae4af592a874","year":2019},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:ad098112481f8bd984b0b6bc387c12e60bab779b2c5e05c575988957e5d0d483","observation_id":"7fa6d33a-6144-46e1-9192-211e77805e09","resolution":{"observed_at":"2026-05-10T12:11:16.558970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:46:46.719407Z","title":"2018 , eprint=","venue":null,"work_id":"9880c11f-6c71-4e36-9736-affdf3d20344","year":2018},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:90d8e95c86407c0392bb247cdb2abbe495d21f103ba795db60ae322bd8b68e96","observation_id":"51eab50a-72cb-4caa-bc6f-2632de4f35ac","resolution":{"observed_at":"2026-05-10T12:11:16.561895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":"2201.11903","doi":"10.48550/arxiv.2201.11903","metadata_source":"pith","pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","venue":"cs.CL","work_id":"d1cf6693-a082-403c-ada9-dac7b96341f9","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:fe80e31b25e9b6ed2b1ba15b1c81788981397c3d71c19020bb45b5841f2be188","observation_id":"814e8297-47ec-4539-911c-2a4e8c7a5016","resolution":{"observed_at":"2026-05-10T12:54:44.857189Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:13.648188+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:13.648188+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"5b9243c8-695b-4011-9306-151067f3d5b6","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6865d04351eb3f310908124c1fb5e0e029010ce7c0b2f847f3fded06afe13fc9","observation_id":"71fbb77d-9016-476e-9955-7a28475aadb1","resolution":{"observed_at":"2026-05-10T12:11:16.564432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11934","last_updated":"2021-03-11T18:45:13Z","snapshot_observed_at":"2026-08-09T05:32:57.900052Z","submitted_at":"2020-10-22T17:58:14Z","title":"mT5: A massively multilingual pre-trained text-to-text transformer","version":3},"cited_work":{"arxiv_id":"2010.11934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.11934","snapshot_observed_at":"2026-07-08T02:24:27.918351Z","title":"mt5: A massively multilingual pre-trained text-to-text transformer","venue":"cs.CL","work_id":"b93889a5-59f1-47b2-aaf3-29d77a967594","year":2020},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2010.11934","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:a60e3faf71d589155dd3b8088958429ff1cca332771c825ee435bf3ce758cb2f","observation_id":"c35a5125-02bf-4f35-8664-0275955e803f","resolution":{"observed_at":"2026-05-10T12:11:16.433596Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"1bf99847-dedf-4930-9683-195631ade6ff","year":2022},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6c82b38bacc6563c62e1939d216b4202d52c4bc6a64e6c27643068ca0d62be45","observation_id":"36b0a1c9-28a4-4e3b-a03a-2dda58342e5b","resolution":{"observed_at":"2026-05-10T12:11:16.566923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:42:44.599455Z","title":"NeurIPS , year=","venue":null,"work_id":"94a2c2a8-689c-410b-ae59-f2cd5993fcb2","year":null},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:dc1f611adea53e31010ded1fc7b7299f9fc9c847a956b80e22e6beabd6e476a7","observation_id":"e02d5a34-6d93-4d01-a705-9121548e9cd3","resolution":{"observed_at":"2026-05-10T12:11:16.569450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-08-09T15:17:43.394064Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":"2112.04359","doi":"10.48550/arxiv.2112.04359","metadata_source":"pith","pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ethical and social risks of harm from Language Models","venue":"cs.CL","work_id":"b4ce1c45-ef69-445a-a872-dbb785b485e9","year":2021},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":131,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:4cf57d1e27f3fe5e71e3879c43a9217e67c6d452eca79546fb01ca56a7cf7965","observation_id":"f0ecb552-6fee-4be8-ae97-6174f93f2183","resolution":{"observed_at":"2026-05-11T18:24:30.556046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":16,"parse_uncertain":0,"unresolved":6,"verified_exact":29,"verified_fuzzy":49},"total_outbound_references":129},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 129 outbound references and 100 inbound Pith citation observations for arXiv:2408.00118."}