{"as_of":"2026-08-09T21:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:982c63cf17ef9e345bc590137f1c89d12c75bed12afec6271e4c0a5da538aad8","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:44.945688Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T16:44:41.720388Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:48:39.449857Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"cited_work":{"arxiv_id":"2505.24844","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24844","snapshot_observed_at":"2026-07-03T16:48:39.449857Z","title":"Chameleon: A flexible data-mixing framework for language model pretraining and finetuning","venue":null,"work_id":"eaf3e70a-28b0-46aa-9d62-b7a6a1657d93","year":2025},"citing_paper":{"arxiv_id":"2604.16380","last_updated":"2026-03-25T13:30:40Z","snapshot_observed_at":"2026-08-08T06:45:13.140900Z","submitted_at":"2026-03-25T13:30:40Z","title":"Data Mixing for Large Language Models Pretraining: A Survey and Outlook","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:04.958757Z"},"links":{"cited_paper":"/paper/2505.24844","citing_paper":"/paper/2604.16380"},"observation_digest":"sha256:1e6adfe8a4aa42b7a5fe4cd70477857ddeea94441c747471fcb1c1b1ac5e4f1e","observation_id":"daa3f0a0-bd0b-41b4-9534-615953804898","resolution":{"observed_at":"2026-05-15T00:58:25.742553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"cited_work":{"arxiv_id":"2505.24844","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24844","snapshot_observed_at":"2026-07-03T16:48:39.449857Z","title":"Chameleon: A flexible data-mixing framework for language model pretraining and finetuning","venue":null,"work_id":"eaf3e70a-28b0-46aa-9d62-b7a6a1657d93","year":2025},"citing_paper":{"arxiv_id":"2607.02266","last_updated":"2026-07-02T14:51:42Z","snapshot_observed_at":"2026-08-08T15:31:37.930459Z","submitted_at":"2026-07-02T14:51:42Z","title":"HERMES: A Multi-Granularity Labeling Substrate for Pre-training Data Mixtures","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-03T16:44:41.720388Z"},"links":{"cited_paper":"/paper/2505.24844","citing_paper":"/paper/2607.02266"},"observation_digest":"sha256:ab2c1ca4494fd8f1364f5cb3c10c435a1d1c967b1c667befe6e01b16adb12e83","observation_id":"0d40c740-2663-4d1c-bb09-1788df5e4c44","resolution":{"observed_at":"2026-07-03T16:48:39.451436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24844/citation-record","integrity":"/paper/2505.24844/integrity","json":"/paper/2505.24844/citation-record.json","paper":"/paper/2505.24844"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:38.503981Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.503981Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7fd4f7ad6c6366577f6d44857ee3a59ab5a63b0b9e3b3e749b215c38092a7850","observation_id":"b3f3af47-ab0b-4944-8a1e-0d11b5d39ba9","resolution":{"observed_at":"2026-08-07T12:35:38.503981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.0306","last_updated":"2015-11-08T20:33:45Z","snapshot_observed_at":"2026-07-06T03:59:18.014244Z","submitted_at":"2014-11-02T19:57:31Z","title":"Fast Randomized Kernel Methods With Statistical Guarantees","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.0306","snapshot_observed_at":"2026-08-07T12:35:38.631002Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.631002Z"},"links":{"cited_paper":"/paper/1411.0306","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:4133f15f0c414f6316a094ddd6c90631e1498ceb1355fd9515f18b2d954270a2","observation_id":"f79284cf-cb42-449d-838c-3a8f2c821a35","resolution":{"observed_at":"2026-08-07T12:35:38.631002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:53.210166Z","title":null,"venue":null,"work_id":"bfe46d29-f03b-49dc-a5e3-5de88f23aa17","year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.718840Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:f7dea336e41592b3ecf545fe47dc0734c7ee7c4eab8ec18be6562abb96f9d2e8","observation_id":"dd4f53e5-1b52-40b0-8d45-6e3e3908d583","resolution":{"observed_at":"2026-08-07T12:35:53.333515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.992585Z","title":"Sharp analysis of low-rank kernel matrix approximations","venue":null,"work_id":"b834c2e9-255d-4d23-b10b-c97678376331","year":2013},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.787906Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:a0516eb5c5ea94cb795f7d6f2af5d22b1dcff779635014a4369f8c56f6f6eccc","observation_id":"9b3b7a62-c4f4-4b78-987d-d7cc769af6f0","resolution":{"observed_at":"2026-08-07T12:35:53.080460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.811848Z","title":"B., and Stylianopoulos, N","venue":null,"work_id":"19295b25-6900-4e7d-b4a3-63618d834fff","year":2021},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.902143Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:735253a3e0a386d00b91597cb7f2166083e5267329d17be5cb83af49986c0e86","observation_id":"a56dba4a-6129-49c8-8ce3-f3eb14834600","resolution":{"observed_at":"2026-08-07T12:35:52.906128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.654364Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":"20db9eca-4a59-4bd8-bc1c-e584c494fa68","year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.976247Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7ac67e151887729580bbf9b54cb8a0430a2c9da7fcac53a0e7ecb71f5d76db2e","observation_id":"2f4e55df-f392-4929-a82a-d736c511e1c1","resolution":{"observed_at":"2026-08-07T12:35:52.731218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:39.047968Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.047968Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:5df15a76ab124699287f8362d68127fce7217f29bd1aae5591c02d5e73ffb8c2","observation_id":"b30ac921-47fb-4036-abd2-5361d1de8069","resolution":{"observed_at":"2026-08-07T12:35:39.047968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.515271Z","title":"Analysis of nystr \\\"o m method with sequential ridge leverage score sampling","venue":null,"work_id":"a3f01000-68a9-4ab1-943b-c065b950d0bc","year":2016},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.122716Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:5245c9ae41512b55da40e028956e5b1fb6ffdc2b5c36236e3a60cfb751da2ef2","observation_id":"7fbd5401-2195-4b69-839d-07d6eea4a633","resolution":{"observed_at":"2026-08-07T12:35:52.574209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.355274Z","title":"and Yang, Y","venue":null,"work_id":"12ff006e-3924-474a-8b68-fdb619557550","year":2021},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.201995Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c583476303520c40a569f22115f2a6bd784d0e8313cd062ce541c9f51d448565","observation_id":"278990ec-cd76-42d6-b790-d54e321149ba","resolution":{"observed_at":"2026-08-07T12:35:52.440369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T12:35:39.280395Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.280395Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:ff2bbbe5010e8a7a957fbda3646c267e4e67bb777b60d00114457468e34c306f","observation_id":"1c6eb76e-8c0a-4689-b2b3-782fa9d66a5a","resolution":{"observed_at":"2026-08-07T12:35:39.280395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07263","last_updated":"2016-10-06T22:48:49Z","snapshot_observed_at":"2026-07-06T04:37:28.029641Z","submitted_at":"2015-11-23T15:10:05Z","title":"Input Sparsity Time Low-Rank Approximation via Ridge Leverage Score Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07263","snapshot_observed_at":"2026-08-07T12:35:39.359944Z","title":"B., Musco, C., and Musco, C","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.359944Z"},"links":{"cited_paper":"/paper/1511.07263","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:bea707671e33c1dfe03f7b0d23340d808da829e0ee7e9f2e340f64d2ae72c02a","observation_id":"e086f306-5235-4db8-b0df-acbfc899db2f","resolution":{"observed_at":"2026-08-07T12:35:39.359944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.185155Z","title":"B., Musco, C., and Musco, C","venue":null,"work_id":"45a9f5c8-c79e-4e46-8e1e-3bb94ffb495d","year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.456117Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:1565de444b581df5d0b82c78e41dc5aaf78a8adcfb616cbcc41231baba298101","observation_id":"01ba9733-8ce0-4bf4-b1e7-3877415db091","resolution":{"observed_at":"2026-08-07T12:35:52.263988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.045130Z","title":"Multivariate christoffel functions and hyperinterpolation","venue":null,"work_id":"f24b6459-1ecd-4397-8624-3089f6ce6f98","year":2014},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.536150Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:9128926a220a9a711c9662a70f9f6e02517e3991fec01f87ba27be2db7d9c0e7","observation_id":"ce4338ec-32a4-4cb6-a4d2-f1892d733728","resolution":{"observed_at":"2026-08-07T12:35:52.122473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:51.841702Z","title":"M., Tong, S., Lepikhin, D., Xu, Y., Krikun, M., Zhou, Y., Yu, A","venue":null,"work_id":"fc1ed593-ae84-4784-a59e-37eddd3f8165","year":2022},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.652667Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:556b0c36d1805363d8bcb123d37b98167cadd106b27f90e1157a2207ae1c2aed","observation_id":"d9b443af-97ae-4350-a8ab-5fd403456981","resolution":{"observed_at":"2026-08-07T12:35:51.922321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:35:39.720002Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.720002Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:8d589fab4f0f2e87e4f175fc2b357a46bc679fb31830b471c4007586cc530edb","observation_id":"380f1443-4da2-442c-86b3-82838e03bb22","resolution":{"observed_at":"2026-08-07T12:35:39.720002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:51.621066Z","title":"Leveraging the christoffel function for outlier detection in data streams","venue":null,"work_id":"65aabf75-f43c-4dbe-a320-848e168f0d6c","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.845167Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7248e7092927eaa6ff2426b3660cf52c69890fb28563b043249dba463751d1ca","observation_id":"d13ab9fc-b31e-41a0-ac62-e48ad12035af","resolution":{"observed_at":"2026-08-07T12:35:51.720521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:51.346262Z","title":null,"venue":null,"work_id":"ca10cf9e-e56b-4866-8853-092a39123f13","year":2014},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.919943Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:59b023867b6db4aef06fe911767e6e74e91da38ba040c7ca363d54cc9d30709d","observation_id":"00054f01-6e16-473e-9eeb-0913ae1d4dcd","resolution":{"observed_at":"2026-08-07T12:35:51.501689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02498","last_updated":"2024-10-03T14:00:44Z","snapshot_observed_at":"2026-08-09T06:28:00.253928Z","submitted_at":"2024-10-03T14:00:44Z","title":"Dynamic Gradient Alignment for Online Data Mixing","version":1},"cited_work":{"arxiv_id":"2410.02498","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02498","snapshot_observed_at":"2026-08-07T12:35:45.299249Z","title":"Dynamic Gradient Alignment for Online Data Mixing","venue":"cs.LG","work_id":"194f7ea2-5f63-414e-a401-4a07661aca56","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.028666Z"},"links":{"cited_paper":"/paper/2410.02498","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:89ee60dba6be48275bd3be43fa3881c32cb9b7ce3e96ee4ff50f980e7b4764df","observation_id":"51e9940f-84a8-4e96-885d-66991935c67f","resolution":{"observed_at":"2026-08-07T12:35:45.364390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:51.070512Z","title":"DOGE : Domain reweighting with generalization estimation","venue":null,"work_id":"396c9bd4-b15a-48e9-8dbb-9855d75e4229","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.166611Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:4fc687de659fa604d7779af710c0d50397a32b11c805d91a52b6728f68d98acd","observation_id":"b3b65340-679b-42bb-bbc7-408c87847d30","resolution":{"observed_at":"2026-08-07T12:35:51.161312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.705059Z","title":null,"venue":null,"work_id":"7f6cacc0-54cf-43ad-b898-e14d7b9e6bf4","year":2022},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.351695Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:b78a83dda3779b03f0fb2c733ad5bad92f4805990fba8ff28c4652a9c292fb42","observation_id":"d7eacd52-3ee0-42af-957d-3736b71854a6","resolution":{"observed_at":"2026-08-07T12:35:50.927863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15285","last_updated":"2024-12-18T18:41:18Z","snapshot_observed_at":"2026-08-09T06:25:22.863608Z","submitted_at":"2024-12-18T18:41:18Z","title":"Maximize Your Data's Potential: Enhancing LLM Accuracy with Two-Phase Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15285","snapshot_observed_at":"2026-08-07T12:35:40.495825Z","title":"Maximize your data's potential: Enhancing llm accuracy with two-phase pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.495825Z"},"links":{"cited_paper":"/paper/2412.15285","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:36603b083e5cd38263434d9f64d4f7a1af45e6a49ef613de671daa03dd7e784e","observation_id":"ed9a85c7-fce3-48df-8edd-4c624c12522a","resolution":{"observed_at":"2026-08-07T12:35:40.495825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T12:35:40.638808Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.638808Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:5fd2172dcd2b9b48a3e29a1a53791f1eb7f65ed7faf4b65e70ef0157a9aaa43b","observation_id":"33e7cd2f-c33a-4fa8-9d0c-3df679a513d1","resolution":{"observed_at":"2026-08-07T12:35:40.638808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.404701Z","title":"A framework for few-shot language model evaluation, 2024","venue":null,"work_id":"785ce8ff-30f0-43ff-819c-91936df84bbf","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.839268Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:61a24b5e8b9372cb50ca232c4367affba1ee7770b42399463c28ee8f41bfcaa9","observation_id":"b2abb185-ba50-4701-a7cc-0209d60c8d74","resolution":{"observed_at":"2026-08-07T12:35:50.506652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.353396Z","title":"An introduction to statistical learning: with applications in R","venue":null,"work_id":"59526bb3-4b84-4a76-b2e5-1480b4abe438","year":2013},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.017439Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:f2d65e3d2b0d5f63e91ad78079ba021a9aa338cacc290e8dcdb14d67bdef3e3e","observation_id":"043fde3c-f671-4c8e-af53-7afc339a4493","resolution":{"observed_at":"2026-08-07T12:35:50.395008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.165935Z","title":"Wiki-40b: Multilingual language model dataset","venue":null,"work_id":"c0958b2e-691e-4863-b267-44e3e8d1f53a","year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.157937Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:f78d9a92e953124584439e11858eec3ef63e5bfb2e2aaa6ee3d13a94d839ebbd","observation_id":"59c670a5-a10c-430d-b88e-1fe7c6a0de53","resolution":{"observed_at":"2026-08-07T12:35:50.249819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.003435Z","title":"The elements of statistical learning: data mining, inference and prediction","venue":null,"work_id":"c7c8d5eb-37ce-4a89-aed6-3929db3902a3","year":2005},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.258586Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:cb784607aea97057f698a2d3f13efb223f974e44e7824aa91ee772e57dd40877","observation_id":"0ca0147c-e911-4038-9912-ae1e484d97a8","resolution":{"observed_at":"2026-08-07T12:35:50.088307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11820","last_updated":"2024-10-15T17:47:44Z","snapshot_observed_at":"2026-08-04T18:20:45.624958Z","submitted_at":"2024-10-15T17:47:44Z","title":"Adaptive Data Optimization: Dynamic Sample Selection with Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11820","snapshot_observed_at":"2026-08-07T12:35:41.369147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.369147Z"},"links":{"cited_paper":"/paper/2410.11820","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:83d96713492fe14554ff0e5a3201b54104f1e1fd01565145c5d79586e2f64bc4","observation_id":"1fb5bd19-70eb-4a72-9e70-11a649b5f5f6","resolution":{"observed_at":"2026-08-07T12:35:41.369147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:41.513536Z","title":"Autoscale: Automatic prediction of compute-optimal data composition for training llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.513536Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c3b4a20c0f5d67e496d8febfa3cbb23c85ae062467ac533876b8e63a2201e6dc","observation_id":"7a0a942d-38d8-4917-a791-0fcef23d878c","resolution":{"observed_at":"2026-08-07T12:35:41.513536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:49.851161Z","title":"Looking beyond the surface: A challenge set for reading comprehension over multiple sentences","venue":null,"work_id":"12562e88-e972-407d-bb64-cfbcadfae9ec","year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.639380Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:048b14c1fcfffa4f955386378f230dc4492274b0d950610595a03a02a00058c3","observation_id":"c592ddbb-c97b-4bbe-a438-535afb3b0a9f","resolution":{"observed_at":"2026-08-07T12:35:49.919292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15533","last_updated":"2022-11-20T18:15:30Z","snapshot_observed_at":"2026-07-06T14:24:01.962012Z","submitted_at":"2022-11-20T18:15:30Z","title":"The Stack: 3 TB of permissively licensed source code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15533","snapshot_observed_at":"2026-08-07T12:35:41.731039Z","title":"B., Li, J., Mou, C., Ferrandis, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.731039Z"},"links":{"cited_paper":"/paper/2211.15533","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7c308388677c5ec86d5da0e63a254d78bb25a271e8dff5b442b89d051c186975","observation_id":"44b966dc-a8f5-4ef8-83e2-45e76205e9dc","resolution":{"observed_at":"2026-08-07T12:35:41.731039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04683","last_updated":"2017-12-05T19:36:03Z","snapshot_observed_at":"2026-08-07T10:40:47.462532Z","submitted_at":"2017-04-15T19:31:41Z","title":"RACE: Large-scale ReAding Comprehension Dataset From Examinations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04683","snapshot_observed_at":"2026-08-07T12:35:41.838461Z","title":"Race: Large-scale reading comprehension dataset from examinations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.838461Z"},"links":{"cited_paper":"/paper/1704.04683","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7b3e3e02e935800bce8519bf5c6bc501841849e1c20faed44686e2566914b092","observation_id":"0199387e-b1d3-480b-af7d-0ae72d21cafb","resolution":{"observed_at":"2026-08-07T12:35:41.838461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:49.460068Z","title":null,"venue":null,"work_id":"bf6435c4-d5f0-44b8-8db0-a078e7a18344","year":2019},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.957391Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:0c8c17a6d0555c29bf23f6e05c7d8e31cac5b077f0ce19193115379f2adebd7d","observation_id":"a4351c0a-630a-4f6e-9047-6a3a5400b16f","resolution":{"observed_at":"2026-08-07T12:35:49.703606Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:48.919166Z","title":"L., and Peng, R","venue":null,"work_id":"96d81380-ee94-4ecc-85b4-a889d3a06877","year":2013},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.054731Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:e5e0505f57ef5ed8c7d736902f26dc553fa99bcb0b963d32a9eafeffef006438","observation_id":"7d0b0457-dd98-405f-b895-4bffbcd3e019","resolution":{"observed_at":"2026-08-07T12:35:49.227083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08124","last_updated":"2020-07-16T05:52:16Z","snapshot_observed_at":"2026-08-09T06:25:20.879304Z","submitted_at":"2020-07-16T05:52:16Z","title":"LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08124","snapshot_observed_at":"2026-08-07T12:35:42.123008Z","title":"Logiqa: A challenge dataset for machine reading comprehension with logical reasoning","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.123008Z"},"links":{"cited_paper":"/paper/2007.08124","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:f583ff12cd1b2abb4e27b1241a2c2cc8456457453228067b8d2cd7f1b23ace66","observation_id":"d17e5040-a200-4cb6-b809-43f28a19b253","resolution":{"observed_at":"2026-08-07T12:35:42.123008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01492","last_updated":"2025-01-23T17:35:43Z","snapshot_observed_at":"2026-08-09T06:27:14.768185Z","submitted_at":"2024-07-01T17:31:03Z","title":"RegMix: Data Mixture as Regression for Language Model Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01492","snapshot_observed_at":"2026-08-07T12:35:42.207728Z","title":"Regmix: Data mixture as regression for language model pre-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.207728Z"},"links":{"cited_paper":"/paper/2407.01492","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:6da04e07555038f52a518d63c69c6c12895a7852ea7632706e67830eb02918cb","observation_id":"7ef517de-48b5-4365-bb9b-1415edd4590a","resolution":{"observed_at":"2026-08-07T12:35:42.207728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:48.547864Z","title":"A pretrainer`s guide to training data: Measuring the effects of data age, domain coverage, quality, & toxicity","venue":null,"work_id":"aac961f5-2f57-440a-889e-cd01c4beae1a","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.302526Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:a487ba8e8cb1212db2706822fd2cfed8e19c45d246ae0fabcbe7d982a09acd16","observation_id":"8cb0cd30-5f23-4188-a319-8bc17f062cd2","resolution":{"observed_at":"2026-08-07T12:35:48.684891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16298","last_updated":"2023-09-30T07:01:13Z","snapshot_observed_at":"2026-07-06T16:24:49.716011Z","submitted_at":"2023-09-28T09:50:27Z","title":"At Which Training Stage Does Code Data Help LLMs Reasoning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16298","snapshot_observed_at":"2026-08-07T12:35:42.400029Z","title":"At which training stage does code data help llms reasoning? arXiv preprint arXiv:2309.16298, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.400029Z"},"links":{"cited_paper":"/paper/2309.16298","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:fb3d55b593044b15b2ac0971f6f59bc38d0784a787cdf591c3265e7fad5a303e","observation_id":"b604cae5-2271-4340-bd58-428587ad586b","resolution":{"observed_at":"2026-08-07T12:35:42.400029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:48.335108Z","title":null,"venue":null,"work_id":"679f6f7e-21c5-42b7-bb03-778386467d98","year":2009},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.551788Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:a5df93962dc59adeaac2907a2faca8b64b82a2886d47dfe2f2f174e471eccbce","observation_id":"5cc82a3e-b6f7-45b5-a4f1-65d731824aed","resolution":{"observed_at":"2026-08-07T12:35:48.414496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.968360Z","title":"When not to trust language models: Investigating effectiveness of parametric and non-parametric memories","venue":null,"work_id":"acce7616-9b2e-4fed-9660-0139e6020429","year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.648814Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:3dfdd4a5fe482659dfb9a52f41d5d96a66500c3df2e5a124cf64285171e0a06f","observation_id":"82154177-26b6-4222-85f4-a8772a31ffa7","resolution":{"observed_at":"2026-08-07T12:35:48.154308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03426","last_updated":"2020-09-18T01:56:41Z","snapshot_observed_at":"2026-08-02T15:32:07.466568Z","submitted_at":"2018-02-09T19:39:33Z","title":"UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03426","snapshot_observed_at":"2026-08-07T12:35:42.804042Z","title":"Umap: Uniform manifold approximation and projection for dimension reduction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.804042Z"},"links":{"cited_paper":"/paper/1802.03426","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:23dd594efffcf4204c71a3f325aad1e886ae25b164a74637d7be1f63df430834","observation_id":"f337cb77-b714-4833-a708-daef5c4f64cd","resolution":{"observed_at":"2026-08-07T12:35:42.804042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-07T12:35:42.897037Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.897037Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:2b872efeda474cc492904645f3784d40825bbab3d30744cc159d8f411295ebb0","observation_id":"bad7de74-0c25-49fd-b56b-08022230fa8b","resolution":{"observed_at":"2026-08-07T12:35:42.897037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.792878Z","title":"and Musco, C","venue":null,"work_id":"aaa40670-fdf4-4bb1-b416-ed35a4b8cd1d","year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.996312Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:de1e542c04a89ffa8cd7e8306fe8db4f1d7e75e34c50d118789d50a7f8aef121","observation_id":"e1959f7f-8fbd-4119-9c60-c8f1a4536c34","resolution":{"observed_at":"2026-08-07T12:35:47.868679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06031","last_updated":"2016-06-20T09:37:17Z","snapshot_observed_at":"2026-08-05T16:27:22.031013Z","submitted_at":"2016-06-20T09:37:17Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06031","snapshot_observed_at":"2026-08-07T12:35:43.087650Z","title":"N., Bernardi, R., Pezzelle, S., Baroni, M., Boleda, G., and Fern \\'a ndez, R","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.087650Z"},"links":{"cited_paper":"/paper/1606.06031","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:4a06302e68aab1fc751f73aa32a7d49b526fde6bf0c923139b283d39069c0853","observation_id":"7c59eaff-d040-4bda-be13-f0055e2cfb84","resolution":{"observed_at":"2026-08-07T12:35:43.087650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06380","last_updated":"2024-10-19T16:51:38Z","snapshot_observed_at":"2026-07-06T18:43:22.614883Z","submitted_at":"2024-07-08T20:47:58Z","title":"Data, Data Everywhere: A Guide for Pretraining Dataset Construction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06380","snapshot_observed_at":"2026-08-07T12:35:43.210706Z","title":"Data, data everywhere: A guide for pretraining dataset construction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.210706Z"},"links":{"cited_paper":"/paper/2407.06380","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:bb9d20789aa7d3e0d8c49ce8552f2816945e260bb8d2ff7fd110a2b39654dc13","observation_id":"e6ac58fd-dcf0-4aa1-a52c-a87c69a632a3","resolution":{"observed_at":"2026-08-07T12:35:43.210706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13296","last_updated":"2024-10-30T01:04:15Z","snapshot_observed_at":"2026-08-08T06:13:30.100547Z","submitted_at":"2024-08-23T14:48:02Z","title":"The Ultimate Guide to Fine-Tuning LLMs from Basics to Breakthroughs: An Exhaustive Review of Technologies, Research, Best Practices, Applied Research Challenges and Opportunities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13296","snapshot_observed_at":"2026-08-07T12:35:43.277388Z","title":"B., Zafar, A., Khan, A., and Shahid, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.277388Z"},"links":{"cited_paper":"/paper/2408.13296","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c0707bcee4346d4a8894ebc182e0461e6565cb16c95303e90c459720881585a7","observation_id":"244660e8-c889-40d0-b79e-f02cbc813d6a","resolution":{"observed_at":"2026-08-07T12:35:43.277388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.604175Z","title":"Relating leverage scores and density using regularized christoffel functions","venue":null,"work_id":"28da1e89-75d8-4ab1-8af5-a2b1d504a9ce","year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.394425Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7238d50f57d3c30ce4238b913cf772a32239ea24f1e528d0e2a3107bd088e7f7","observation_id":"8d059221-f8d1-4d27-9d31-2c07972dee6b","resolution":{"observed_at":"2026-08-07T12:35:47.678146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.435651Z","title":"Falkon: An optimal large scale kernel method","venue":null,"work_id":"c02ba2b9-25f6-417e-a8a6-f1d9f633eade","year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.481067Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c1855c98f17f063e961456eb44431a04316bff8d8b110e89abb8928ba5655c8f","observation_id":"91ca0a5d-bda1-4d00-b818-82f9c0eae9f6","resolution":{"observed_at":"2026-08-07T12:35:47.531788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.240445Z","title":"On fast leverage score sampling and optimal learning","venue":null,"work_id":"2bad36e6-a28e-4a58-9eb8-b2c22c65e1f1","year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.550515Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:b432a570c8785c705d9d0db94ecce06b0cbcc9f516a4e84af1c63122c2aa983f","observation_id":"44dda75b-1c18-4e14-979b-3125ce1b0ef2","resolution":{"observed_at":"2026-08-07T12:35:47.334377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.098306Z","title":"W., Hashimoto, T","venue":null,"work_id":"13c5d949-5a6d-4a9e-bc54-8f005e62754c","year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.661039Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:922f96fc2aed45a0a3f7abef7147de5592ea18b239a6f55a461be65661b7a737","observation_id":"13a410b8-2423-41a9-9932-d907f680f02e","resolution":{"observed_at":"2026-08-07T12:35:47.166816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.912509Z","title":"L., Bhagavatula, C., and Choi, Y","venue":null,"work_id":"7fb1aece-104b-41d1-93e7-b24eded165ae","year":2021},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.759872Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:e567acfd26a5a172a8d8cdb49f48f6591f03cc6c953f8613b4bbb31e7d10a767","observation_id":"a6f33091-d00f-4906-a6c2-95b580a7b1cd","resolution":{"observed_at":"2026-08-07T12:35:46.982119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-08-07T12:35:43.845142Z","title":"Socialiqa: Commonsense reasoning about social interactions","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.845142Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:267d60989fd1d5debba6bc57252c6cb24fc17e6716818d0ba0c82da7dedc2cbf","observation_id":"c9862cc0-9dbd-45ba-9ff8-878343a3146f","resolution":{"observed_at":"2026-08-07T12:35:43.845142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.743582Z","title":"Superglue: Learning feature matching with graph neural networks","venue":null,"work_id":"f469dc63-8682-474b-8f6f-ceff0cd131b9","year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.941226Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c1c272e8929f09b37804144142db8ca895f8a5612ac41f0f889d33a00a12bc57","observation_id":"252658e2-bfaf-448a-b50b-a0d16113da04","resolution":{"observed_at":"2026-08-07T12:35:46.809132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.578270Z","title":null,"venue":null,"work_id":"11a477cb-1d6a-469f-983d-6fc5d77c5377","year":2001},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.077211Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:597eea221ce20f20709a1c27a2df93fa8775c050b38dd84544299eced068b11d","observation_id":"dca80466-c8a3-42bc-9c43-91a16adddafc","resolution":{"observed_at":"2026-08-07T12:35:46.672149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10818","last_updated":"2024-05-09T13:56:06Z","snapshot_observed_at":"2026-08-07T23:26:20.937888Z","submitted_at":"2023-09-19T17:59:54Z","title":"SlimPajama-DC: Understanding Data Combinations for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10818","snapshot_observed_at":"2026-08-07T12:35:44.169610Z","title":"Slimpajama-dc: Understanding data combinations for llm training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.169610Z"},"links":{"cited_paper":"/paper/2309.10818","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:9ffc91494d3f10198f6824d83744f1881ac3e474f4a30b8bd4dffa3ba51b1207","observation_id":"68de9851-dcfe-4231-a816-3a668ff1a055","resolution":{"observed_at":"2026-08-07T12:35:44.169610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.404383Z","title":"R., Hestness, J., and Dey, N","venue":null,"work_id":"968477f1-8c7a-44cd-a0ee-61f243d394de","year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.265934Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7ed5a0293ca985a01e08b3da6fd5b4727555d27d1fab32efd9d06c4473fa38f9","observation_id":"b5b8a180-72cf-44ca-996f-2adf63905bf7","resolution":{"observed_at":"2026-08-07T12:35:46.483514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.217894Z","title":null,"venue":null,"work_id":"13f9990c-2a4b-4f1c-88de-d1f02da4cb55","year":1999},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.370685Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:e2c299baa093705854dcc413e588544d1d626171c7c1843c9d14f009629aa7d8","observation_id":"260c8516-a786-4aa6-9a78-0a5b57cbb685","resolution":{"observed_at":"2026-08-07T12:35:46.303556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.009184Z","title":"N., Kaiser, L","venue":null,"work_id":"f6f81f4a-6cf0-4142-8487-152f19aa6fbe","year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.430256Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:40c6a53fd60b571dc5c3d85d134d23a48a010bee77f71ba8bed9956fbf99fa1b","observation_id":"2c8a2fc8-5afd-4fb1-af99-59103a2155a1","resolution":{"observed_at":"2026-08-07T12:35:46.106489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-07T12:35:44.518896Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.518896Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:39d8a875e16b84fc9039482cfd9ab4ebe5cce559930e417e4724ca2ec2a2401b","observation_id":"33580535-e89e-4bd8-80f1-339ed89cfe22","resolution":{"observed_at":"2026-08-07T12:35:44.518896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-06T06:05:27.671303Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-07T12:35:44.600639Z","title":"F., and Gardner, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.600639Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:835a6331f090b4d00a4ae71697849a92e91059e92375ca127d8dce55915ecd67","observation_id":"07c17dd7-463b-4d89-a894-286945055dbf","resolution":{"observed_at":"2026-08-07T12:35:44.600639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:45.836067Z","title":"M., Pham, H., Dong, X., Du, N., Liu, H., Lu, Y., Liang, P., Le, Q","venue":null,"work_id":"ae5e5add-0d2d-4fc2-8a6d-a968745a5af8","year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.680872Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:9d37b91aadfa5dd24235b49dd0436b2f5fae1d8ad3de8792555b780617313f60","observation_id":"3feeeabe-7f0d-4ce5-ae89-4dbf3c0c4ee5","resolution":{"observed_at":"2026-08-07T12:35:45.908361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:45.656369Z","title":"N., and Mirzasoleiman, B","venue":null,"work_id":"802e3613-8f94-43ee-8658-1fa1859e6965","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.748439Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:0c00f752c2760e0b347e3c473ffbd141b0a53717e041cd5f88ef0870c417eafa","observation_id":"a3642873-dedc-4f25-85fd-309da848bf11","resolution":{"observed_at":"2026-08-07T12:35:45.740683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16952","last_updated":"2025-03-20T03:31:27Z","snapshot_observed_at":"2026-07-06T17:50:18.017647Z","submitted_at":"2024-03-25T17:14:00Z","title":"Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16952","snapshot_observed_at":"2026-08-07T12:35:44.851956Z","title":"Data mixing laws: Optimizing data mixtures by predicting language modeling performance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.851956Z"},"links":{"cited_paper":"/paper/2403.16952","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:9158db64014b0be9ad75657930cc2a8659227d127e1b3867b551646a8fa46aca","observation_id":"a6e03e86-85cd-4257-912e-4fb29755758a","resolution":{"observed_at":"2026-08-07T12:35:44.851956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:45.510035Z","title":"H ella S wag: Can a machine really finish your sentence? In Annual Meeting of the Association for Computational Linguistics (ACL), pp.\\ 4791--4800, 2019","venue":null,"work_id":"2709aa09-ed96-459e-bb16-ee3f726a39b7","year":2019},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.945688Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:5c6f5d47930aefe15a9a64562ead9b8de89eff40ed7b000833a561f4cfed7ef5","observation_id":"cffc16bb-1f22-4850-bad5-7542e0b0237c","resolution":{"observed_at":"2026-08-07T12:35:45.575582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T13:33:17.540834Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 2 inbound Pith citation observations for arXiv:2505.24844."}