{"as_of":"2026-08-18T14:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2356b503fb58f832d14866e1cb0c9c960fcdf95712e4921d795e946e63e90d6f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":233,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:33:18.184764Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"reference_index":132,"source":"pdf_text","source_observed_at":"2026-05-17T22:58:16.523267Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2406.11794"},"observation_digest":"sha256:ea7e90a3424b3fb319e88f5143b7b068d0aa64a525002bc8e7c7b0f0d5c7bb64","observation_id":"ddee7678-1c91-447b-be14-8c25c0330955","resolution":{"observed_at":"2026-05-17T22:58:17.152963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-10T23:08:28.532201Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.21124","last_updated":"2025-03-16T21:10:15Z","snapshot_observed_at":"2026-08-17T20:30:23.005028Z","submitted_at":"2024-12-30T17:55:28Z","title":"Adaptive Batch Size Schedules for Distributed Training of Language Models with Data and Model Parallelism","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:28.532201Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2412.21124"},"observation_digest":"sha256:965e81192faf150939627090a75180a3b37746c119ca96f7ff77fc9ae125e068","observation_id":"40cd2d9e-5b48-473f-8c59-f296d3c16d4b","resolution":{"observed_at":"2026-08-10T23:08:28.532201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-10T05:28:04.836641Z","title":"W., Liu, J., Malik, S., Merrill, W., Miranda, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16975","last_updated":"2025-05-23T08:32:07Z","snapshot_observed_at":"2026-08-16T10:44:18.951863Z","submitted_at":"2025-01-28T14:15:42Z","title":"Over-Tokenized Transformer: Vocabulary is Generally Worth Scaling","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T05:28:04.836641Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2501.16975"},"observation_digest":"sha256:1c1361259967c9d706f2ba524e31b5d477bbba9d3e30d89a3597dba59c57947a","observation_id":"687fe0dc-fcfb-47eb-b9de-84b349581c0c","resolution":{"observed_at":"2026-08-10T05:28:04.836641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-09T11:23:40.972128Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02732","last_updated":"2025-06-06T11:19:11Z","snapshot_observed_at":"2026-08-17T01:30:08.653623Z","submitted_at":"2025-02-04T21:29:47Z","title":"Peri-LN: Revisiting Normalization Layer in the Transformer Architecture","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T11:23:40.972128Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.02732"},"observation_digest":"sha256:43e14a9b6b619e29fc9319688e5d198804b39e5fa3b643472d8be61f4caec6d9","observation_id":"18b61c7c-d3ba-4f10-9f51-c300bec588ee","resolution":{"observed_at":"2026-08-09T11:23:40.972128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-08-15T00:53:48.099058Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"reference_index":157,"source":"arxiv_source","source_observed_at":"2026-05-12T15:39:40.845703Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.05171"},"observation_digest":"sha256:06e75123d2951fdeb22edd443263df860048386a434eb804632b66b985749d7f","observation_id":"98b07108-0b9d-4b91-8d17-b108103d1ad3","resolution":{"observed_at":"2026-05-12T15:39:41.264090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-08T19:11:50.262150Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05489","last_updated":"2025-06-30T00:37:41Z","snapshot_observed_at":"2026-08-12T22:22:47.717610Z","submitted_at":"2025-02-08T08:11:37Z","title":"Mechanistic Interpretability of Emotion Inference in Large Language Models","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-08T19:11:50.262150Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.05489"},"observation_digest":"sha256:6141ccfdb163ff37185ad4e05935e8f27400d8a0896dba425c78b252eed6746e","observation_id":"eee9c57b-44b0-4e1d-a4e4-9434af4f6d10","resolution":{"observed_at":"2026-08-08T19:11:50.262150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-08T17:19:29.220412Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05967","last_updated":"2025-06-05T08:10:47Z","snapshot_observed_at":"2026-08-14T20:35:59.020868Z","submitted_at":"2025-02-09T17:31:09Z","title":"$\\mu$nit Scaling: Simple and Scalable FP8 LLM Training","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T17:19:29.220412Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.05967"},"observation_digest":"sha256:9c1632cfebf6de3fcee7525c974b2cf80927bb6d258c7a158c51028e0272c524","observation_id":"f9c9cec1-849b-4b84-ae3a-4f0d1c8534cc","resolution":{"observed_at":"2026-08-08T17:19:29.220412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-08T14:50:58.847851Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06635","last_updated":"2025-02-13T07:31:55Z","snapshot_observed_at":"2026-08-18T12:57:24.202558Z","submitted_at":"2025-02-10T16:31:37Z","title":"Steel-LLM:From Scratch to Open Source -- A Personal Journey in Building a Chinese-Centric LLM","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T14:50:58.847851Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.06635"},"observation_digest":"sha256:53b43849ba50ae013e6babe9dc3e970a033ca74947c1e3c4e1e70a87635dd2e4","observation_id":"c95999a9-6160-4527-919b-376fdcc893e0","resolution":{"observed_at":"2026-08-08T14:50:58.847851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2502.07963","last_updated":"2026-04-22T01:40:55Z","snapshot_observed_at":"2026-08-17T07:21:18.565218Z","submitted_at":"2025-02-11T21:21:05Z","title":"Caught in the Web of Words: Do LLMs Fall for Spin in Medical Literature?","version":4},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-23T03:13:01.979380Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.07963"},"observation_digest":"sha256:0715bda3f7d2a5215af33e99a99ff91ac1bcdd5f051255a20f29127fb82802b7","observation_id":"6b867926-ab30-4291-b87e-916c6f391552","resolution":{"observed_at":"2026-05-23T03:15:21.330405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-08T05:20:20.525219Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08395","last_updated":"2025-09-10T10:08:08Z","snapshot_observed_at":"2026-08-17T15:04:51.768171Z","submitted_at":"2025-02-12T13:37:03Z","title":"IssueBench: Millions of Realistic Prompts for Measuring Issue Bias in LLM Writing Assistance","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T05:20:20.525219Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.08395"},"observation_digest":"sha256:835c81d8e1d5291c62f1acd472072df3a9adb8c35fd4c6428174f0d75751d9a8","observation_id":"36349e1b-9126-4815-ae28-5d1a23913d46","resolution":{"observed_at":"2026-08-08T05:20:20.525219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-08T00:04:57.347576Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08640","last_updated":"2025-02-19T06:48:30Z","snapshot_observed_at":"2026-08-16T12:58:16.280754Z","submitted_at":"2025-02-12T18:55:43Z","title":"Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIs","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T00:04:57.347576Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.08640"},"observation_digest":"sha256:4792f7987b1291e33418d23d7fce6f1322f8e1d611d7527095abbe5174fdcf18","observation_id":"6ed1555d-8948-492c-a937-3150dc97c38e","resolution":{"observed_at":"2026-08-08T00:04:57.347576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T22:52:54.383384Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09042","last_updated":"2025-03-27T06:45:15Z","snapshot_observed_at":"2026-08-13T21:03:43.034767Z","submitted_at":"2025-02-13T07:55:54Z","title":"Typhoon T1: An Open Thai Reasoning Model","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T22:52:54.383384Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.09042"},"observation_digest":"sha256:d3742bf84c3c218720263d52145c2de6d274c79754bafec154315a909192d0fb","observation_id":"8a543fd5-e789-47d2-a376-efeaffc5e79e","resolution":{"observed_at":"2026-08-07T22:52:54.383384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T18:33:11.481504Z","title":"Team OLMo, Pete Walsh, Luca Soldaini, Dirk Groen- eveld, Kyle Lo, Shane Arora, Akshita Bhagia, Yuling Gu, Shengyi Huang, Matt Jordan, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10341","last_updated":"2025-07-16T07:09:29Z","snapshot_observed_at":"2026-08-14T15:17:42.222016Z","submitted_at":"2025-02-14T18:02:37Z","title":"Organize the Web: Constructing Domains Enhances Pre-Training Data Curation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T18:33:11.481504Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.10341"},"observation_digest":"sha256:15a30028b0419e1ccccc14dd14be0e9e4a65a600d8623223461e1dbac23681ee","observation_id":"350c1a09-be16-4467-af4e-e8a49f9a5a77","resolution":{"observed_at":"2026-08-07T18:33:11.481504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-16T22:48:15.725816Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-11T23:02:51.656353Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2502.16982"},"observation_digest":"sha256:7369dfb22edd2b104afe42d21d309de51285da4b72615408ec53c4aa816753f4","observation_id":"19daf070-9e86-4e00-9fc2-cad4bbef2b63","resolution":{"observed_at":"2026-05-11T23:02:51.983358Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2504.12501","last_updated":"2026-08-03T01:47:58Z","snapshot_observed_at":"2026-08-16T12:27:55.152640Z","submitted_at":"2025-04-16T21:36:46Z","title":"Reinforcement Learning from Human Feedback","version":9},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T19:27:40.991325Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.12501"},"observation_digest":"sha256:3a8c81324444ae3503e10c224e37e3f8c0e0a23158556bf12f98267c58ffa629","observation_id":"027af90b-0fdc-4402-b086-bd7f7a45cbf0","resolution":{"observed_at":"2026-05-22T19:32:01.436886Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-16T12:33:18.184764Z","title":"2 OLMo 2 furious,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12501","last_updated":"2026-08-03T01:47:58Z","snapshot_observed_at":"2026-08-16T12:27:55.152640Z","submitted_at":"2025-04-16T21:36:46Z","title":"Reinforcement Learning from Human Feedback","version":11},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T12:33:18.184764Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.12501"},"observation_digest":"sha256:25ac337bbb43f6167422ca967f9935b3258eafeed45bab8fb9ad7599129a55e2","observation_id":"7ef569de-dfa1-4897-bf8b-efa5ad329963","resolution":{"observed_at":"2026-08-16T12:33:18.184764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-16T11:40:27.726822Z","title":"2 olmo 2 furious.arXiv preprint arXiv:2501.00656, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14992","last_updated":"2025-04-24T04:13:49Z","snapshot_observed_at":"2026-08-18T09:07:23.317188Z","submitted_at":"2025-04-21T09:41:26Z","title":"Efficient Pretraining Length Scaling","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:40:27.726822Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.14992"},"observation_digest":"sha256:ca11fe496d3bdd199cd8d39f70bde952c5e0ea81621eeaef74ddbae54d74aa51","observation_id":"10601342-b229-4e83-bc93-b1f013364f00","resolution":{"observed_at":"2026-08-16T11:40:27.726822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-16T11:32:05.991938Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15431","last_updated":"2025-04-21T20:54:44Z","snapshot_observed_at":"2026-08-16T11:24:41.443927Z","submitted_at":"2025-04-21T20:54:44Z","title":"Trillion 7B Technical Report","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T11:32:05.991938Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.15431"},"observation_digest":"sha256:8c007671759a603b41915f91db5b80644fd8ad236efeb64125d4131c9e705e67","observation_id":"b8bd1b4c-0b7f-4177-9b81-3570c16ebc27","resolution":{"observed_at":"2026-08-16T11:32:05.991938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-16T11:28:01.877083Z","title":"Murray, Crystal Nam, Valentina Pyatkin, Aman Rangapur, Michael Schmitz, Sam Skjonsberg, David Wadden, Chris Wilhelm, Michael Wilson, Luke S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15527","last_updated":"2025-04-22T02:08:45Z","snapshot_observed_at":"2026-08-17T14:41:49.816681Z","submitted_at":"2025-04-22T02:08:45Z","title":"Compass-V2 Technical Report","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T11:28:01.877083Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.15527"},"observation_digest":"sha256:3934348f13fd63df3441ee05e830319cc6fe466815ca369bf4f8e669e1d2feec","observation_id":"ff8441f6-204c-49f8-96d7-5189c9ed0686","resolution":{"observed_at":"2026-08-16T11:28:01.877083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-16T10:59:50.753667Z","title":"Smith, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16832","last_updated":"2025-08-09T14:54:48Z","snapshot_observed_at":"2026-08-16T10:52:31.648510Z","submitted_at":"2025-04-23T15:48:55Z","title":"GreenMind: A Next-Generation Vietnamese Large Language Model for Structured and Logical Reasoning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T10:59:50.753667Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.16832"},"observation_digest":"sha256:9b8d5ef7050b91a13c6005b16ad74baa6e2d39c215cab9c8a5e44bc703178d1b","observation_id":"bab605b1-4804-40f0-a9e1-235eaf0f647d","resolution":{"observed_at":"2026-08-16T10:59:50.753667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-16T10:37:51.394728Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17674","last_updated":"2025-04-24T15:45:05Z","snapshot_observed_at":"2026-08-18T02:14:14.397027Z","submitted_at":"2025-04-24T15:45:05Z","title":"Energy Considerations of Large Language Model Inference and Efficiency Optimizations","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T10:37:51.394728Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.17674"},"observation_digest":"sha256:77b0251d543b015c8772ae858943ea74098e95c965b88624afe3117a60d6d226","observation_id":"52df6c16-fa65-4139-9d7d-7aa8bb4e8697","resolution":{"observed_at":"2026-08-16T10:37:51.394728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-16T10:25:14.898038Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.18225","last_updated":"2025-04-25T10:17:04Z","snapshot_observed_at":"2026-08-16T10:19:10.205144Z","submitted_at":"2025-04-25T10:17:04Z","title":"Even Small Reasoners Should Quote Their Sources: Introducing the Pleias-RAG Model Family","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T10:25:14.898038Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2504.18225"},"observation_digest":"sha256:31a09090e2da0252b1fa4ed22ffa4409cd29b295de3658b1c1a6b6d571ddf616","observation_id":"9d896858-7398-4eb7-a54a-9a8e3ba791df","resolution":{"observed_at":"2026-08-16T10:25:14.898038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2505.06120","last_updated":"2025-05-09T15:21:44Z","snapshot_observed_at":"2026-08-13T15:54:05.532542Z","submitted_at":"2025-05-09T15:21:44Z","title":"LLMs Get Lost In Multi-Turn Conversation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-14T00:57:10.262350Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.06120"},"observation_digest":"sha256:f81b6c3cb72521f8d9e02249d641571ae74e80983e422cfbb50add7e855751f8","observation_id":"35298816-2bc1-4b49-b39f-dfaf92772afa","resolution":{"observed_at":"2026-05-14T01:11:09.278893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T22:26:59.363288Z","title":"W., Liu, J., Malik, S., Merrill, W., Miranda, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.07271","last_updated":"2025-05-12T06:48:26Z","snapshot_observed_at":"2026-08-15T22:18:39.037371Z","submitted_at":"2025-05-12T06:48:26Z","title":"On the Robustness of Reward Models for Language Model Alignment","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T22:26:59.363288Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.07271"},"observation_digest":"sha256:69526c3251bd38c1a095187b8d6a91004d2ce0e305690a77c799c9aa817a1d91","observation_id":"a287af6c-df6d-4d37-a3e2-441506b1312b","resolution":{"observed_at":"2026-08-15T22:26:59.363288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T22:23:36.309882Z","title":"2 olmo 2 furious.arXiv preprint arXiv:2501.00656, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07293","last_updated":"2025-05-12T07:25:51Z","snapshot_observed_at":"2026-08-17T05:02:04.504086Z","submitted_at":"2025-05-12T07:25:51Z","title":"AttentionInfluence: Adopting Attention Head Influence for Weak-to-Strong Pretraining Data Selection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T22:23:36.309882Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.07293"},"observation_digest":"sha256:e47b11ab01a3e3f08675d17dab8d4c8b391dd8fcd0342325eeb08a6a36840f7f","observation_id":"d5fc0da0-896e-4e02-8ebf-acdffd5c36c4","resolution":{"observed_at":"2026-08-15T22:23:36.309882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T21:55:07.808536Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08620","last_updated":"2025-05-13T14:39:33Z","snapshot_observed_at":"2026-08-18T06:10:16.545831Z","submitted_at":"2025-05-13T14:39:33Z","title":"Resource-Efficient Language Models: Quantization for Fast and Accessible Inference","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T21:55:07.808536Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.08620"},"observation_digest":"sha256:2b4cf2f2dbd21d2024ff513e0acff41ad85ae0e4c69544efbd5b72dbef4a1447","observation_id":"ebf99f63-2438-4240-a0f0-29eddb7c528b","resolution":{"observed_at":"2026-08-15T21:55:07.808536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T21:09:01.145744Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10775","last_updated":"2025-05-16T01:27:03Z","snapshot_observed_at":"2026-08-15T21:01:35.130546Z","submitted_at":"2025-05-16T01:27:03Z","title":"A Systematic Analysis of Base Model Choice for Reward Modeling","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T21:09:01.145744Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.10775"},"observation_digest":"sha256:0cf2f9874d336105f9aae2ec33ccb05c7d302239fab5ae8a323d1db4506b01e3","observation_id":"1a005f4f-5379-4571-8443-8b72c9f5b189","resolution":{"observed_at":"2026-08-15T21:09:01.145744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T20:44:25.944153Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12182","last_updated":"2025-07-08T07:21:15Z","snapshot_observed_at":"2026-08-18T11:46:53.807711Z","submitted_at":"2025-05-18T00:47:21Z","title":"Truth Neurons","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:44:25.944153Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.12182"},"observation_digest":"sha256:cb0687f735c8d6c825a8bd9f3b1550405717d54bd4a09ef10cada18097a9ef88","observation_id":"06c4ffd9-d1b8-490a-8e4c-68e6f27c44b5","resolution":{"observed_at":"2026-08-15T20:44:25.944153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T15:42:29.875453Z","title":"{taxonomy}","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14071","last_updated":"2025-05-20T08:23:08Z","snapshot_observed_at":"2026-08-16T18:22:58.224871Z","submitted_at":"2025-05-20T08:23:08Z","title":"Textual Steering Vectors Can Improve Visual Understanding in Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:29.875453Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.14071"},"observation_digest":"sha256:96fa8ed554dfc1941a9ff9ff38ae5ca5ad42bb57048ad796a0ce7e452fad8469","observation_id":"196a1e9a-71b0-4ac1-b608-7f780741b43c","resolution":{"observed_at":"2026-08-07T15:42:29.875453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T15:41:07.983240Z","title":"2 olmo 2 furious.arXiv preprint arXiv:2501.00656, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14302","last_updated":"2025-05-20T12:54:43Z","snapshot_observed_at":"2026-08-14T10:57:46.400268Z","submitted_at":"2025-05-20T12:54:43Z","title":"Scaling Law for Quantization-Aware Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:07.983240Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.14302"},"observation_digest":"sha256:1debc9770f9aeafa1d68094907bfc042d2d19e9540fb6c6b2ef7061f8e2125c3","observation_id":"d00b3f19-8afd-4a88-a38c-851596f59091","resolution":{"observed_at":"2026-08-07T15:41:07.983240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T15:37:37.715185Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14543","last_updated":"2025-05-20T15:58:54Z","snapshot_observed_at":"2026-08-13T16:30:28.776060Z","submitted_at":"2025-05-20T15:58:54Z","title":"Time to Embed: Unlocking Foundation Models for Time Series with Channel Descriptions","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:37.715185Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.14543"},"observation_digest":"sha256:05faa1e82c6298225a634d0950db028f98cc354d0e6517062092b1974e14fff1","observation_id":"8f10a553-d9b7-4eb1-824d-3079a2651822","resolution":{"observed_at":"2026-08-07T15:37:37.715185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2505.17855","last_updated":"2026-04-26T15:27:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-23T13:06:43Z","title":"Explaining Sources of Uncertainty in Automated Fact-Checking","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T13:23:38.217467Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.17855"},"observation_digest":"sha256:26ff2fa1d6195838af541687d05d793141a225d241d01e73ca1c6343afc80812","observation_id":"93c1afc5-8372-4c47-b607-61e5464fd885","resolution":{"observed_at":"2026-05-19T13:27:19.015019Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T14:26:09.279901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19116","last_updated":"2025-07-20T08:57:14Z","snapshot_observed_at":"2026-08-11T23:04:38.656350Z","submitted_at":"2025-05-25T12:15:31Z","title":"Controlling Language Confusion in Multilingual LLMs","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:26:09.279901Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.19116"},"observation_digest":"sha256:36c06b45e39e6639b6a338bc9871eee148e0885b6a3b0d809e9f690a60e94a4b","observation_id":"925ef49d-7054-4e85-9746-e8d3abd3263d","resolution":{"observed_at":"2026-08-07T14:26:09.279901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T14:12:40.714477Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19797","last_updated":"2025-06-18T09:47:20Z","snapshot_observed_at":"2026-08-17T20:19:26.264835Z","submitted_at":"2025-05-26T10:29:42Z","title":"The Avengers: A Simple Recipe for Uniting Smaller Language Models to Challenge Proprietary Giants","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:12:40.714477Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.19797"},"observation_digest":"sha256:e8299cadf7d6f307ff280b32a0deb3c18202290e19d384213ab48070b05f9ca7","observation_id":"906f2532-a3ce-40eb-9603-cb6ba7dbaac1","resolution":{"observed_at":"2026-08-07T14:12:40.714477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T13:30:23.644760Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21701","last_updated":"2025-05-30T14:39:34Z","snapshot_observed_at":"2026-08-16T23:34:55.352739Z","submitted_at":"2025-05-27T19:39:49Z","title":"Do We Know What LLMs Don't Know? A Study of Consistency in Knowledge Probing","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.644760Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.21701"},"observation_digest":"sha256:8f722871ab6857266c9dced6321a8d2a79fbb7ad79a7238945bfdd598c0431f6","observation_id":"18003982-0d7d-4531-96d0-785666ad9529","resolution":{"observed_at":"2026-08-07T13:30:23.644760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T13:28:24.305109Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21828","last_updated":"2025-05-27T23:29:32Z","snapshot_observed_at":"2026-08-17T18:31:52.954921Z","submitted_at":"2025-05-27T23:29:32Z","title":"SAGE-Eval: Evaluating LLMs for Systematic Generalizations of Safety Facts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:24.305109Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.21828"},"observation_digest":"sha256:ed41285c4a4a314e0c8c4e040cf512b4a462ac6f5640bd6b8abf442cbc2c79d1","observation_id":"ca7a3a86-8766-4924-bc21-d4ce195e5851","resolution":{"observed_at":"2026-08-07T13:28:24.305109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T12:34:44.956720Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24302","last_updated":"2026-07-21T01:12:17Z","snapshot_observed_at":"2026-08-07T16:41:29.098287Z","submitted_at":"2025-05-30T07:28:20Z","title":"ScienceMeter: Tracking Scientific Knowledge Updates in Language Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:44.956720Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2505.24302"},"observation_digest":"sha256:bdd61c5ba8f6a604d7ec7144f56f695e694091c44fd92e4517a5205b311cae1b","observation_id":"a65719df-192d-4ebe-a47a-7792132d108c","resolution":{"observed_at":"2026-08-07T12:34:44.956720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T11:32:32.586962Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02204","last_updated":"2025-06-09T23:17:27Z","snapshot_observed_at":"2026-08-16T20:51:32.281960Z","submitted_at":"2025-06-02T19:44:06Z","title":"BehaviorBox: Automated Discovery of Fine-Grained Performance Differences Between Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:32:32.586962Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.02204"},"observation_digest":"sha256:8722ce0b85222f7d1f386be0b25ac8577f003b59ba507b6f8902b8d8760a5b7a","observation_id":"c7a97efb-ba89-43b4-8c69-c294a59ce2a4","resolution":{"observed_at":"2026-08-07T11:32:32.586962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T11:31:53.700853Z","title":"Python Code Quality Authority","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02211","last_updated":"2025-06-02T19:50:16Z","snapshot_observed_at":"2026-08-16T13:45:01.747227Z","submitted_at":"2025-06-02T19:50:16Z","title":"Improving LLM-Generated Code Quality with GRPO","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:31:53.700853Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.02211"},"observation_digest":"sha256:80f5c525159f35f4ad7e281b2edf9881add3eeb94606d59e16a8f6542597244e","observation_id":"e9bfec68-2cfd-40d0-a16a-60fa32f7e1e5","resolution":{"observed_at":"2026-08-07T11:31:53.700853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T10:44:13.916263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04534","last_updated":"2025-06-05T00:59:05Z","snapshot_observed_at":"2026-08-16T08:45:51.926458Z","submitted_at":"2025-06-05T00:59:05Z","title":"Is It JUST Semantics? A Case Study of Discourse Particle Understanding in LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:44:13.916263Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.04534"},"observation_digest":"sha256:3f5e9e16976acd0eebcd32ba491d52dfdc78141a721597cc4d6bee7c2c235b49","observation_id":"15625959-9092-4b0d-b0c2-fd3ecce60c83","resolution":{"observed_at":"2026-08-07T10:44:13.916263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T10:19:09.100923Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05767","last_updated":"2025-06-06T05:51:29Z","snapshot_observed_at":"2026-08-13T21:22:22.224742Z","submitted_at":"2025-06-06T05:51:29Z","title":"dots.llm1 Technical Report","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:09.100923Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.05767"},"observation_digest":"sha256:5cac4c4c31655fb960bb4f5e071d11b9a554abcf4427fac17019670d9b96e4b1","observation_id":"de4206f7-58c5-4b9b-881c-f4cbb172ddd2","resolution":{"observed_at":"2026-08-07T10:19:09.100923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2506.07298","last_updated":"2026-04-24T00:35:40Z","snapshot_observed_at":"2026-08-11T18:19:18.277777Z","submitted_at":"2025-06-08T21:49:38Z","title":"Pre-trained Large Language Models Learn Hidden Markov Models In-context","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T10:34:40.987583Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.07298"},"observation_digest":"sha256:662d613c37cc0fcfb7b03656d69a2aca6f2bc06f9f1b2c5e4d8b7d5944eae8c5","observation_id":"b16dd07f-3262-4d16-9f1e-b72846fb3547","resolution":{"observed_at":"2026-05-19T10:37:15.048937Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T04:46:37.725138Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09796","last_updated":"2025-06-11T14:41:10Z","snapshot_observed_at":"2026-08-17T16:55:30.135714Z","submitted_at":"2025-06-11T14:41:10Z","title":"Do LLMs Give Psychometrically Plausible Responses in Educational Assessments?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:46:37.725138Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.09796"},"observation_digest":"sha256:e9b24758c2330731346d08d048825f8969cfd688bca52a5f368ddbb560bc6c78","observation_id":"863ba8f3-22dc-4a2f-ba83-8feaaf6c3c8c","resolution":{"observed_at":"2026-08-07T04:46:37.725138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2506.10947","last_updated":"2026-02-25T01:06:05Z","snapshot_observed_at":"2026-08-14T00:59:03.111530Z","submitted_at":"2025-06-12T17:49:55Z","title":"Spurious Rewards: Rethinking Training Signals in RLVR","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T13:37:51.086217Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.10947"},"observation_digest":"sha256:918f70b6cf3f5cae406e0d329ee118664e98eb7da6d99d34c3a4dfab013da505","observation_id":"2dea4de5-be44-48d8-b64c-93c47805eaa6","resolution":{"observed_at":"2026-05-16T13:37:51.117231Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T01:03:41.101622Z","title":"2 olmo 2 furious,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12217","last_updated":"2025-06-13T20:40:13Z","snapshot_observed_at":"2026-08-18T02:24:34.375824Z","submitted_at":"2025-06-13T20:40:13Z","title":"From Emergence to Control: Probing and Modulating Self-Reflection in Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:41.101622Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.12217"},"observation_digest":"sha256:f383d5cf2d03e3084a82bdc24cf4e0b39160c1cbc653ed50bf45182588d34807","observation_id":"469303ad-d1e6-4663-a969-09b9a3aad043","resolution":{"observed_at":"2026-08-07T01:03:41.101622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T00:59:56.935537Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12301","last_updated":"2025-06-14T01:30:17Z","snapshot_observed_at":"2026-08-12T07:32:16.943974Z","submitted_at":"2025-06-14T01:30:17Z","title":"Unveiling Confirmation Bias in Chain-of-Thought Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T00:59:56.935537Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.12301"},"observation_digest":"sha256:a166a3a6583ff6a880893aefdcef91769f61461cedc7ea9cd95d9de3671b89a0","observation_id":"3842c017-5967-414e-8b42-1a449b81ec09","resolution":{"observed_at":"2026-08-07T00:59:56.935537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2506.14123","last_updated":"2026-05-07T07:43:36Z","snapshot_observed_at":"2026-08-11T17:02:54.244928Z","submitted_at":"2025-06-17T02:37:04Z","title":"Sampling from Your Language Model One Byte at a Time","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-19T09:52:20.923710Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.14123"},"observation_digest":"sha256:407c1145cd7b939c2c386377dc8ab89ab27190de74b557e5d5e98a7bdda078c4","observation_id":"64df9e9d-41ec-4e63-8d41-0fadd33228fe","resolution":{"observed_at":"2026-05-19T09:53:02.090243Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-07T00:14:42.316595Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14948","last_updated":"2025-06-17T19:59:44Z","snapshot_observed_at":"2026-08-17T12:20:18.804577Z","submitted_at":"2025-06-17T19:59:44Z","title":"Structured Moral Reasoning in Language Models: A Value-Grounded Evaluation Framework","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T00:14:42.316595Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.14948"},"observation_digest":"sha256:dffdaec94d40378cce14ab1f6ca947b4ca4917c09dc01cc8792721eef906fffb","observation_id":"40790639-bca0-48c2-8337-26d3ae508de1","resolution":{"observed_at":"2026-08-07T00:14:42.316595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T23:57:40.233595Z","title":"In Proceedings of the 29th International Conference on Computational Linguistics, pages 3578–3588, Gyeongju, Republic of Korea","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15629","last_updated":"2025-06-18T17:00:54Z","snapshot_observed_at":"2026-08-15T13:46:20.859424Z","submitted_at":"2025-06-18T17:00:54Z","title":"Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:40.233595Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.15629"},"observation_digest":"sha256:2f93655c5e30d5c2230ae0f42f191da5da7ac1a234e2e1746b92a5e546dda7e8","observation_id":"6ba05634-7b53-4ab3-a68a-26b8a9270f49","resolution":{"observed_at":"2026-08-06T23:57:40.233595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2506.17299","last_updated":"2026-04-24T04:36:54Z","snapshot_observed_at":"2026-08-02T14:45:34.223522Z","submitted_at":"2025-06-17T20:37:29Z","title":"Toward Principled LLM Safety Testing: Solving the Jailbreak Oracle Problem","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T08:40:56.186349Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.17299"},"observation_digest":"sha256:98e9a80085066c947c7d7d801bfe20f1caba1a187563097b74c957c3948a9a9d","observation_id":"adbbd26c-4fff-4016-8bf1-d75f9103a319","resolution":{"observed_at":"2026-05-19T08:42:12.857025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T23:35:36.704077Z","title":"Olmo 2 furious,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17611","last_updated":"2025-06-21T06:30:59Z","snapshot_observed_at":"2026-08-10T07:54:14.180718Z","submitted_at":"2025-06-21T06:30:59Z","title":"OpusLM: A Family of Open Unified Speech Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:35:36.704077Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.17611"},"observation_digest":"sha256:8bb97fc7d01ae3ba7080bc428a0d713a7e8a0aa6266891b072282e7d196115b4","observation_id":"7d548fb4-ed25-440b-a023-a30419e2dd8a","resolution":{"observed_at":"2026-08-06T23:35:36.704077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T18:42:45.943588Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19140","last_updated":"2025-06-23T21:21:49Z","snapshot_observed_at":"2026-08-16T14:08:40.785561Z","submitted_at":"2025-06-23T21:21:49Z","title":"Command-V: Pasting LLM Behaviors via Activation Profiles","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T18:42:45.943588Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.19140"},"observation_digest":"sha256:423cd1a549132d6834c59f94b2b53920438f2283eed0dcfa7105b0bc7189f099","observation_id":"57095482-851a-4e4f-a48f-3766dd97f223","resolution":{"observed_at":"2026-08-15T18:42:45.943588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T22:52:05.441159Z","title":"Murray, Crystal Nam, Valentina Pyatkin, Aman Rangapur, Michael Schmitz, Sam Skjonsberg, David Wadden, Chris Wilhelm, Michael Wilson, Luke S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20512","last_updated":"2025-06-25T14:58:13Z","snapshot_observed_at":"2026-08-13T20:01:19.714358Z","submitted_at":"2025-06-25T14:58:13Z","title":"OctoThinker: Mid-training Incentivizes Reinforcement Learning Scaling","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T22:52:05.441159Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.20512"},"observation_digest":"sha256:42b11898e1c051298c3670cd0a3a99294f26222931d23fd957db6bf53e5a44be","observation_id":"71955f78-bbb2-49d3-973e-4d8085020009","resolution":{"observed_at":"2026-08-06T22:52:05.441159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2506.20941","last_updated":"2026-04-27T18:06:07Z","snapshot_observed_at":"2026-08-02T21:32:45.612265Z","submitted_at":"2025-06-26T02:16:16Z","title":"Revisiting the Past: Data Unlearning with Model State History","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T08:12:19.391973Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.20941"},"observation_digest":"sha256:79a93797cd25b308f02787ec5da2dabc2c31f1704f9130274273e8410c729981","observation_id":"7bf7552f-9942-4d01-a150-f1c9f831e1ac","resolution":{"observed_at":"2026-05-19T08:13:01.666132Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T22:40:54.186326Z","title":"repo\": \"bartowski/gemma-2-9b-it-GGUF","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20982","last_updated":"2025-06-26T03:54:25Z","snapshot_observed_at":"2026-08-06T22:34:12.081457Z","submitted_at":"2025-06-26T03:54:25Z","title":"Our Coding Adventure: Using LLMs to Personalise the Narrative of a Tangible Programming Robot for Preschoolers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:40:54.186326Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2506.20982"},"observation_digest":"sha256:bdf28f5acbe014262afc1f794eefd7da15c8e1ae2db4f33ca496fb8ee7f8d474","observation_id":"94f9095d-1b12-4352-9da0-bd3b064d8eae","resolution":{"observed_at":"2026-08-06T22:40:54.186326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T20:45:14.418323Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01880","last_updated":"2025-07-02T16:50:49Z","snapshot_observed_at":"2026-08-14T09:45:13.316964Z","submitted_at":"2025-07-02T16:50:49Z","title":"Evolving HPC services to enable ML workloads on HPE Cray EX","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:14.418323Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.01880"},"observation_digest":"sha256:90ad7bcb57bfb35b2d7c69072ab374a885f2acab40bbdee868368d042d374289","observation_id":"e1e34171-6a8f-4955-a3e1-5e4dcc36c105","resolution":{"observed_at":"2026-08-06T20:45:14.418323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2507.02833","last_updated":"2025-11-11T09:40:12Z","snapshot_observed_at":"2026-08-14T11:40:59.457005Z","submitted_at":"2025-07-03T17:44:33Z","title":"Generalizing Verifiable Instruction Following","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T05:39:56.467519Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.02833"},"observation_digest":"sha256:98dcb4b6b4ba0b8b0cd7c575819eadd871a6b6da42f4aa54dc7ded53dc7e76ed","observation_id":"e5a0fdbf-8661-4377-ad63-96d82ec66c76","resolution":{"observed_at":"2026-05-19T05:42:05.978804Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T19:28:57.016499Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05913","last_updated":"2025-07-08T11:59:48Z","snapshot_observed_at":"2026-08-14T17:12:39.618474Z","submitted_at":"2025-07-08T11:59:48Z","title":"Best-of-N through the Smoothing Lens: KL Divergence and Regret Analysis","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T19:28:57.016499Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.05913"},"observation_digest":"sha256:b54de10eb09b865bb034ddb25f5b3139d262d8848362760ec85089c3376b6b80","observation_id":"b786f6be-7028-450b-a487-f725761866db","resolution":{"observed_at":"2026-08-06T19:28:57.016499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T19:20:16.562460Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05965","last_updated":"2025-07-08T13:19:00Z","snapshot_observed_at":"2026-08-16T22:47:02.503811Z","submitted_at":"2025-07-08T13:19:00Z","title":"OpenFActScore: Open-Source Atomic Evaluation of Factuality in Text Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:20:16.562460Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.05965"},"observation_digest":"sha256:90135d62d54fa7a314e131c6f5b2199492de1fdfbfe8185b6ed131dbb8a7fc8f","observation_id":"1f95f0ca-0750-4bf0-a127-fd0dfae8872e","resolution":{"observed_at":"2026-08-06T19:20:16.562460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2507.06056","last_updated":"2026-04-20T04:08:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-08T14:58:28Z","title":"Data Compressibility Quantifies LLM Memorization","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T06:00:12.027708Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.06056"},"observation_digest":"sha256:a4f37e0c1a9ac2f4afa19cb9296d42a9165c8e842097c492f93dca39e78a1d0e","observation_id":"f00986f8-68a0-41ad-8b62-dca17bf3335f","resolution":{"observed_at":"2026-05-19T06:02:07.698488Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T17:52:01.667668Z","title":"Tigges, C., Hanna, M., Yu, Q., and Biderman, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10616","last_updated":"2025-07-25T11:09:53Z","snapshot_observed_at":"2026-08-17T16:33:13.140704Z","submitted_at":"2025-07-13T19:04:17Z","title":"Scalpel vs. Hammer: GRPO Amplifies Existing Capabilities, SFT Replaces Them","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:52:01.667668Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.10616"},"observation_digest":"sha256:ba96ff1a8d11c15a42540d37e3a02abe79b453264710f22745f3ab8d7cca2bae","observation_id":"fa093905-f19a-41f1-8a2d-452069abcbde","resolution":{"observed_at":"2026-08-06T17:52:01.667668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T17:52:50.536159Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10618","last_updated":"2025-07-13T21:28:02Z","snapshot_observed_at":"2026-08-12T23:35:40.213269Z","submitted_at":"2025-07-13T21:28:02Z","title":"Compute Requirements for Algorithmic Innovation in Frontier AI Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T17:52:50.536159Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.10618"},"observation_digest":"sha256:174ec1e9d0ce123aacc92c7a35d358dd5802f37d8dafe5e7f539f29a2ec49827","observation_id":"96c23c3a-279b-4e92-bae0-f37dcaeb5e94","resolution":{"observed_at":"2026-08-06T17:52:50.536159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T16:54:45.309967Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12296","last_updated":"2025-07-16T14:49:45Z","snapshot_observed_at":"2026-08-18T13:41:58.382446Z","submitted_at":"2025-07-16T14:49:45Z","title":"Humans are more gullible than LLMs in believing common psychological myths","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:54:45.309967Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.12296"},"observation_digest":"sha256:b62cd892ef787affc3091012c62998460c7c91b39affc75fcd2bd071cf8ad861","observation_id":"921e3415-54b0-432e-a047-3668687e4f9c","resolution":{"observed_at":"2026-08-06T16:54:45.309967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T16:15:02.930719Z","title":"2 olmo 2 furious.arXiv preprint arXiv:2501.00656(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14111","last_updated":"2026-08-05T22:03:49Z","snapshot_observed_at":"2026-08-09T23:09:14.608641Z","submitted_at":"2025-07-18T17:43:56Z","title":"CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning","version":11},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:02.930719Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.14111"},"observation_digest":"sha256:aa1dee168e2d5a5f047b91c6b184ea1f1160dfb1bc7ab8ec2976cde9262869b4","observation_id":"39d25d1d-be25-449f-af66-ff5022cca858","resolution":{"observed_at":"2026-08-06T16:15:02.930719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T15:50:39.059137Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14900","last_updated":"2025-07-23T14:32:32Z","snapshot_observed_at":"2026-08-17T23:01:22.734144Z","submitted_at":"2025-07-20T10:23:22Z","title":"From Neurons to Semantics: Evaluating Cross-Linguistic Alignment Capabilities of Large Language Models via Neurons Alignment","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T15:50:39.059137Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.14900"},"observation_digest":"sha256:a4a1c0d323f8adea5b73eee6886cb79f3068729491ae2fd1e3e824b4811a7c5f","observation_id":"8ca91080-b366-46ec-9063-50b4453f75a5","resolution":{"observed_at":"2026-08-06T15:50:39.059137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:661891818d7ff780cbc7af9214747ac9eb961cb6d6b88a30fb4638ac398628ea","observation_id":"ff554539-dc20-46a0-b969-8b611b068b72","resolution":{"observed_at":"2026-05-19T03:37:00.892082Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T13:09:23.280581Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20956","last_updated":"2025-07-28T16:04:25Z","snapshot_observed_at":"2026-08-14T03:35:46.718200Z","submitted_at":"2025-07-28T16:04:25Z","title":"Mind the Gap: Conformative Decoding to Improve Output Diversity of Instruction-Tuned Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T13:09:23.280581Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.20956"},"observation_digest":"sha256:54b42debe94f6b13a1c1ae17b7e22e28bfbb98e7ef01f464056a486039adf119","observation_id":"ee444413-19ae-4747-8ed1-11bc65f42d75","resolution":{"observed_at":"2026-08-06T13:09:23.280581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T11:59:52.220699Z","title":"2 olmo 2 furious.arXiv preprint arXiv:2501.00656,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22250","last_updated":"2025-07-29T21:56:45Z","snapshot_observed_at":"2026-08-06T11:59:51.689888Z","submitted_at":"2025-07-29T21:56:45Z","title":"Using Scaling Laws for Data Source Utility Estimation in Domain-Specific Pre-Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:59:52.220699Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.22250"},"observation_digest":"sha256:497665dc059d8dbdd759a36e2978e6bf2780b5fdd666ca203d11353356558abb","observation_id":"93cb03ac-6bab-406d-b554-468247dd7f54","resolution":{"observed_at":"2026-08-06T11:59:52.220699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T10:57:11.573685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23319","last_updated":"2025-07-31T08:02:04Z","snapshot_observed_at":"2026-08-08T05:55:35.291718Z","submitted_at":"2025-07-31T08:02:04Z","title":"What's Taboo for You? - An Empirical Evaluation of LLMs Behavior Toward Sensitive Content","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T10:57:11.573685Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.23319"},"observation_digest":"sha256:31f36d7636ca61cad624b0a54ce145924ac54fc1bf0a803f3bc98be24a08c1a3","observation_id":"4f4ab2ac-32e5-4295-9549-e384d0aeff4d","resolution":{"observed_at":"2026-08-06T10:57:11.573685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T05:57:29.368001Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01059","last_updated":"2025-08-01T20:25:57Z","snapshot_observed_at":"2026-08-15T18:39:11.148268Z","submitted_at":"2025-08-01T20:25:57Z","title":"Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct Technical Report","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:29.368001Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2508.01059"},"observation_digest":"sha256:7fee8500bb6bf843fbb991123edaaea11d2450da0328fa3e0b918a86dba5766f","observation_id":"1d6b766b-b6c1-42e5-9e98-48e0d1d618f7","resolution":{"observed_at":"2026-08-06T05:57:29.368001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T05:43:17.964372Z","title":"W.; Liu, J.; Malik, S.; Merrill, W.; Miranda, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-13T13:39:01.162259Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.964372Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:3695919ccac37a3cb0b20dc61776b8d130a2d6534f51cf10f4402a824255cc32","observation_id":"a28123b8-e427-4432-b22d-cd957093d1eb","resolution":{"observed_at":"2026-08-06T05:43:17.964372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T05:02:53.778261Z","title":"Preprint, arXiv:2501.00656","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02513","last_updated":"2025-08-04T15:18:41Z","snapshot_observed_at":"2026-08-13T10:54:56.392847Z","submitted_at":"2025-08-04T15:18:41Z","title":"Modular Arithmetic: Language Models Solve Math Digit by Digit","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:02:53.778261Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2508.02513"},"observation_digest":"sha256:af3df10d1d9e062dddd714cb1a86417ba3eb88e0372de6395f0a5e46aaa7d80d","observation_id":"795b420e-6fa3-47cd-acce-1ecff9f84a10","resolution":{"observed_at":"2026-08-06T05:02:53.778261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T17:21:06.757147Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13144","last_updated":"2025-08-18T17:56:04Z","snapshot_observed_at":"2026-08-18T03:59:35.024516Z","submitted_at":"2025-08-18T17:56:04Z","title":"Signal and Noise: A Framework for Reducing Uncertainty in Language Model Evaluation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:21:06.757147Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2508.13144"},"observation_digest":"sha256:54e0261e4a9d336aa16be78eaeb6bc511c20e27438146c0d49952cafeeb27d08","observation_id":"617c3e2f-5a1d-4520-a575-3613e1b2bccf","resolution":{"observed_at":"2026-08-15T17:21:06.757147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T16:47:20.021791Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.021791Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:d6dbe2c7360994a4f66b25a22bb851db77ed516204bf2c1fba787e659cefd48c","observation_id":"6e4971e3-565b-4c16-835c-d849e7d7ba9c","resolution":{"observed_at":"2026-08-05T16:47:20.021791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T14:49:35.897657Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20869","last_updated":"2025-08-28T15:00:51Z","snapshot_observed_at":"2026-08-17T19:19:33.792848Z","submitted_at":"2025-08-28T15:00:51Z","title":"OLMoASR: Open Models and Data for Training Robust Speech Recognition Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T14:49:35.897657Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2508.20869"},"observation_digest":"sha256:f9c286c3e6e48debefd14ebec684eee8296e3ee7f9e734417486e25b708c4ded","observation_id":"d156c2fd-ff8e-48a2-8f0e-6b0293a3bee1","resolution":{"observed_at":"2026-08-05T14:49:35.897657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T12:58:38.581152Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01093","last_updated":"2025-09-01T03:32:50Z","snapshot_observed_at":"2026-08-17T13:00:35.276709Z","submitted_at":"2025-09-01T03:32:50Z","title":"Natural Context Drift Undermines the Natural Language Understanding of Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T12:58:38.581152Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.01093"},"observation_digest":"sha256:f2f121533d6ae56da9eda9d570ab6fe3c10558ea58af0d67c80c8c1a7229b818","observation_id":"4509dc4c-1a6d-4a47-9fe2-f146f823e504","resolution":{"observed_at":"2026-08-05T12:58:38.581152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T11:47:20.073435Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02225","last_updated":"2025-09-02T11:43:21Z","snapshot_observed_at":"2026-08-16T23:10:30.196668Z","submitted_at":"2025-09-02T11:43:21Z","title":"Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T11:47:20.073435Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.02225"},"observation_digest":"sha256:ed6a8147e6f58953491fc1fe2c493a05eb3f9618798c0c0aa2678e0176ded029","observation_id":"87e5d363-7e22-4e88-97d7-151446e8e08f","resolution":{"observed_at":"2026-08-05T11:47:20.073435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T11:01:14.785708Z","title":"In Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03405","last_updated":"2025-09-03T15:31:18Z","snapshot_observed_at":"2026-08-15T18:22:58.514827Z","submitted_at":"2025-09-03T15:31:18Z","title":"LMEnt: A Suite for Analyzing Knowledge in Language Models from Pretraining Data to Representations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:01:14.785708Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.03405"},"observation_digest":"sha256:e6006283ae34b2ad472679b4e9f8fe532290aa9bb593c2c306b34c5870563940","observation_id":"3237fef2-336c-4cbf-9c99-9c51c0260694","resolution":{"observed_at":"2026-08-05T11:01:14.785708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T10:16:19.469383Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04304","last_updated":"2025-09-04T15:17:50Z","snapshot_observed_at":"2026-08-07T03:29:23.124763Z","submitted_at":"2025-09-04T15:17:50Z","title":"Facts Fade Fast: Evaluating Memorization of Outdated Medical Knowledge in Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T10:16:19.469383Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.04304"},"observation_digest":"sha256:d4adfa0952b20d977daa93127a4098da9b72160b0e179959ee30ac0dc3288bf9","observation_id":"80625325-89e8-42d4-9341-a5a3b0e57c6b","resolution":{"observed_at":"2026-08-05T10:16:19.469383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-04T23:33:34.506640Z","title":"W., Liu, J., Malik, S., Merrill, W., Miranda, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06518","last_updated":"2025-09-08T10:24:19Z","snapshot_observed_at":"2026-08-14T18:24:10.709024Z","submitted_at":"2025-09-08T10:24:19Z","title":"Crown, Frame, Reverse: Layer-Wise Scaling Variants for LLM Pre-Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T23:33:34.506640Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.06518"},"observation_digest":"sha256:322f766b5f7dacec0a6a2b7782128f910bdc40cdeb3d59e1073ebae220b86e1d","observation_id":"99989e5f-0210-4686-b550-a4d9f0eb1173","resolution":{"observed_at":"2026-08-04T23:33:34.506640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T16:18:26.720234Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.720234Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:5f4d03f9320d819491c1726d1eb9952ab6527733f8076783d5ecc61334796e3e","observation_id":"d991638c-7ceb-4786-8cda-ba0bd085f3a2","resolution":{"observed_at":"2026-08-15T16:18:26.720234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-04T17:15:27.882256Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.11026","last_updated":"2025-09-14T01:33:14Z","snapshot_observed_at":"2026-08-17T15:04:28.681013Z","submitted_at":"2025-09-14T01:33:14Z","title":"Rethinking Human Preference Evaluation of LLM Rationales","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T17:15:27.882256Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.11026"},"observation_digest":"sha256:e37983c0be25c558be90114bd0ac38b7ea1845f80ad3db65967e313951608d7e","observation_id":"2996221c-3aa0-4582-8b8d-822dc2b55ca9","resolution":{"observed_at":"2026-08-04T17:15:27.882256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-04T17:10:43.443144Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.11106","last_updated":"2025-09-14T05:49:42Z","snapshot_observed_at":"2026-08-18T02:46:12.736692Z","submitted_at":"2025-09-14T05:49:42Z","title":"Fluid Language Model Benchmarking","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T17:10:43.443144Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.11106"},"observation_digest":"sha256:8ca9cb0fa593fd7f0cddb71fa0753c691af0efa60fad87cedbb740f11fe474d2","observation_id":"fbf8f2b6-9853-4079-9070-264881ad0f24","resolution":{"observed_at":"2026-08-04T17:10:43.443144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T15:52:00.735957Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.21013","last_updated":"2026-07-01T00:59:13Z","snapshot_observed_at":"2026-08-16T11:56:42.286800Z","submitted_at":"2025-09-25T11:20:38Z","title":"Predicting LLM Reasoning Performance with Small Proxy Model","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T15:52:00.735957Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.21013"},"observation_digest":"sha256:a5ca9a61a3ea6e4aad322ef88776647d96e8855ff30dc8c4bab38a9d2745edef","observation_id":"df750432-c7c6-4100-baf4-9f8b0e38f8a4","resolution":{"observed_at":"2026-08-15T15:52:00.735957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T15:47:22.499676Z","title":"2025.DOI:10","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.22092","last_updated":"2025-09-26T09:12:21Z","snapshot_observed_at":"2026-08-15T15:42:40.961476Z","submitted_at":"2025-09-26T09:12:21Z","title":"Ground-Truthing AI Energy Consumption: Validating CodeCarbon Against External Measurements","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T15:47:22.499676Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.22092"},"observation_digest":"sha256:494d4b0395112eec6c86fcd1c38adc75b1a5d212cea66133073d0789d4c42125","observation_id":"7d123e4f-fa86-44b4-955e-a10e0ca0d043","resolution":{"observed_at":"2026-08-15T15:47:22.499676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2509.22367","last_updated":"2026-04-03T11:15:05Z","snapshot_observed_at":"2026-08-16T20:33:26.851789Z","submitted_at":"2025-09-26T14:00:51Z","title":"What Is The Political Content in LLMs' Pre- and Post-Training Data?","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-18T12:36:48.153588Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.22367"},"observation_digest":"sha256:29dc54418f6c7bcb26b5ebb50a132ee073ca9db2c2869eb5d926dcf40c3c9a5a","observation_id":"6f245162-ca3b-4942-b3bd-8cba76104630","resolution":{"observed_at":"2026-05-18T12:41:22.902556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-04T14:43:17.173482Z","title":"2 OLMo 2 Furious","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23982","last_updated":"2026-06-10T12:58:24Z","snapshot_observed_at":"2026-08-15T00:25:20.553384Z","submitted_at":"2025-09-28T17:16:16Z","title":"Toward Preference-aligned Large Language Models via Residual-based Model Steering","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:17.173482Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.23982"},"observation_digest":"sha256:e32305bfbe0dca4178247ebc11acd52df74f048c9a0ba3fd63a47ef7cf1fc188","observation_id":"c1c33619-4d4f-49d3-a22b-f65c2f731370","resolution":{"observed_at":"2026-08-04T14:43:17.173482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-04T11:06:09.040075Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07074","last_updated":"2026-07-26T16:06:08Z","snapshot_observed_at":"2026-08-16T09:20:28.975670Z","submitted_at":"2025-10-08T14:35:59Z","title":"LuxInstruct: A Cross-Lingual Instruction Tuning Dataset For Luxembourgish","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T11:06:09.040075Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2510.07074"},"observation_digest":"sha256:b8f0850a0b84490727383becd794cbe71b440b81dfb39fb648fa252c8f429704","observation_id":"62577a2e-00d8-4209-9023-1c0e08a886dc","resolution":{"observed_at":"2026-08-04T11:06:09.040075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-04T09:38:47.843248Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14717","last_updated":"2026-07-27T17:12:10Z","snapshot_observed_at":"2026-08-15T03:52:36.821423Z","submitted_at":"2025-10-16T14:17:38Z","title":"Seesaw: Accelerating Training by Balancing Learning Rate and Batch Size Scheduling","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T09:38:47.843248Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2510.14717"},"observation_digest":"sha256:b9c09e1a6ee1243070a6d381aeb2057e768f0ce52fbb821e2a6f6a62ae775b76","observation_id":"87d5d1db-de43-46d8-942e-c648d380d2ea","resolution":{"observed_at":"2026-08-04T09:38:47.843248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2510.17001","last_updated":"2026-04-20T09:49:51Z","snapshot_observed_at":"2026-08-02T08:09:49.675839Z","submitted_at":"2025-10-19T20:56:58Z","title":"Vocab Diet: Reshaping the Vocabulary of LLMs via Vector Arithmetic","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T05:54:04.948619Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2510.17001"},"observation_digest":"sha256:9bf5b8572caf11503780377eec938c29a044ecc7affaf1c911a0769a180451fa","observation_id":"ce1167fe-3ec3-4338-b59d-56a32b5fce52","resolution":{"observed_at":"2026-05-18T05:55:56.684630Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2511.07833","last_updated":"2026-05-09T19:03:03Z","snapshot_observed_at":"2026-08-16T13:31:42.647932Z","submitted_at":"2025-11-11T05:03:22Z","title":"MURPHY: Feedback-Aware GRPO with Retrospective Credit Assignment for Multi-Turn Code Generation","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-17T23:13:43.754235Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2511.07833"},"observation_digest":"sha256:1ba31408d260e44b4ddaacc667bf19cdb9ad5ce2f6a41d135ec359d34f34b20c","observation_id":"d253d772-7e72-419a-be9a-2a5655fdfa45","resolution":{"observed_at":"2026-05-17T23:15:26.681922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-08-13T19:30:37.668913Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:3cf8f5040e2cec3f40ca02daa6a6c7c5213849d9d9cebc29cfc5cf26bed185fc","observation_id":"f4c1f2d2-c6d2-4ab4-b7be-dd3b9369d595","resolution":{"observed_at":"2026-05-11T16:50:29.153357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2601.03746","last_updated":"2026-04-17T08:50:42Z","snapshot_observed_at":"2026-08-08T11:18:18.999270Z","submitted_at":"2026-01-07T09:35:35Z","title":"Whose Facts Win? LLM Source Preferences under Knowledge Conflicts","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T17:00:26.394110Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2601.03746"},"observation_digest":"sha256:33b673b56ddfddb1eb05db20a4ab0163ea50449b0c156ba85b7affffda9a4880","observation_id":"9c61409f-7b98-4950-a412-a3678eb54f65","resolution":{"observed_at":"2026-05-16T17:01:07.743071Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-03T10:13:15.145479Z","title":"org/abs/2501.00656","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.11061","last_updated":"2026-06-24T20:10:42Z","snapshot_observed_at":"2026-08-18T03:58:22.501788Z","submitted_at":"2026-01-16T07:55:38Z","title":"Spurious Rewards Paradox: Mechanistically Understanding How RLVR Activates Memorization Shortcuts in LLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T10:13:15.145479Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2601.11061"},"observation_digest":"sha256:1136a75e673024b9558e5a8b10fb6b7c5ee0bcfd4f8b7275b48acbf1d823ae61","observation_id":"d3ae321a-ec46-4c73-a723-a87ea545fefd","resolution":{"observed_at":"2026-08-03T10:13:15.145479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2601.21366","last_updated":"2026-05-13T13:56:23Z","snapshot_observed_at":"2026-08-15T20:05:27.025847Z","submitted_at":"2026-01-29T07:47:46Z","title":"Perceptrons and localization of attention's mean-field landscape","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T09:49:27.206423Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2601.21366"},"observation_digest":"sha256:5ff41408736648f6e1072bd01a7cd2f84707adfde346717bbc98ecca8f9439b1","observation_id":"0a75a0bb-50d5-46c6-9366-72d0cd7bfe78","resolution":{"observed_at":"2026-05-16T09:50:49.230458Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-03T05:00:58.527963Z","title":"2 olmo 2 furious","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.03542","last_updated":"2026-06-03T16:48:57Z","snapshot_observed_at":"2026-08-15T15:14:08.381551Z","submitted_at":"2026-02-03T13:56:54Z","title":"Can Large Language Models Generalize Procedures Across Representations?","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-03T05:00:58.527963Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2602.03542"},"observation_digest":"sha256:c44f1198d523fbaa31860570c985fc27fbc5b003395f4335543b22be42347e97","observation_id":"4964229a-45e5-4d1c-92e7-dd0fb6316ef8","resolution":{"observed_at":"2026-08-03T05:00:58.527963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2602.03839","last_updated":"2026-05-19T16:03:06Z","snapshot_observed_at":"2026-08-17T11:19:27.233176Z","submitted_at":"2026-02-03T18:56:48Z","title":"Understanding and Exploiting Weight Update Sparsity for Communication-Efficient Distributed RL","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-21T13:37:20.114152Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2602.03839"},"observation_digest":"sha256:e79a8dc992f5f6cc24b30e5cbd23a6ed1e6a0b3b122e747126edee86b4e57926","observation_id":"a3ac1f85-4200-40b8-b714-dd384b6db13d","resolution":{"observed_at":"2026-05-21T13:40:12.430293Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-03T04:54:47.449649Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.03846","last_updated":"2026-06-15T22:17:43Z","snapshot_observed_at":"2026-08-16T12:22:33.332478Z","submitted_at":"2026-02-03T18:59:42Z","title":"PLATE: Plasticity-Tunable Efficient Adapters for Geometry-Aware Continual Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T04:54:47.449649Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2602.03846"},"observation_digest":"sha256:5ed121f748265c1927abe81ba2e40a975ce9ea6922427df80d425bff7aa17029","observation_id":"eed00cdf-5110-4d92-9d25-cc7ebf6018d2","resolution":{"observed_at":"2026-08-03T04:54:47.449649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-03T03:32:52.383145Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.07930","last_updated":"2026-06-22T09:55:01Z","snapshot_observed_at":"2026-08-11T02:10:11.458007Z","submitted_at":"2026-02-08T11:56:39Z","title":"Patches of Nonlinearity: Instruction Vectors in Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-03T03:32:52.383145Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2602.07930"},"observation_digest":"sha256:815fc2c1b73c0d8f58709ee1908204c753a8c92fa5239a871252bd6fbc11a0e6","observation_id":"6f0abfaf-4587-4ba0-b9ec-07bdc0efde7d","resolution":{"observed_at":"2026-08-03T03:32:52.383145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-03T00:15:37.326795Z","title":"2 OLMo 2 Furious.arXiv preprint arXiv:2501.00656,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11137","last_updated":"2026-05-28T23:29:40Z","snapshot_observed_at":"2026-08-03T19:24:57.288331Z","submitted_at":"2026-02-11T18:49:26Z","title":"Weight Decay Improves Language Model Plasticity","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T00:15:37.326795Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2602.11137"},"observation_digest":"sha256:d8fe7f728de02ddf5f7a3cfd91d55cd24f9a5dc93645e0af4de67e82a4c421de","observation_id":"abf6f2bc-06dc-4a2a-85cb-d47b320475b9","resolution":{"observed_at":"2026-08-03T00:15:37.326795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.00656/citation-record","integrity":"/paper/2501.00656/integrity","json":"/paper/2501.00656/citation-record.json","paper":"/paper/2501.00656"},"outbound":[],"paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 100 inbound Pith citation observations for arXiv:2501.00656."}