{"as_of":"2026-08-20T14:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a61443fd2419963d8ddba7d2eae491c04011795158cb37cc9879ad1ce1e094a","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:25:00.352149Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:53:35.432279Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T16:07:08.941549Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"cited_work":{"arxiv_id":"2505.04741","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.04741","snapshot_observed_at":"2026-07-02T16:07:08.941549Z","title":"When bad data leads to good models,","venue":null,"work_id":"bca91b48-af68-4e92-8d16-b0f2610c6eda","year":2025},"citing_paper":{"arxiv_id":"2606.07387","last_updated":"2026-06-05T15:24:36Z","snapshot_observed_at":"2026-08-14T18:36:18.353420Z","submitted_at":"2026-06-05T15:24:36Z","title":"Making the Most of Limited Data: Score-Aware Training for Text-to-Music Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T23:00:07.144841Z"},"links":{"cited_paper":"/paper/2505.04741","citing_paper":"/paper/2606.07387"},"observation_digest":"sha256:9be2fd077e0e3b4ba3d5cc7e1366f6239cb0531b6ebaed1332d5eeabf661e21a","observation_id":"10b518e5-d95a-4060-9b57-3d13b862019b","resolution":{"observed_at":"2026-07-02T16:07:08.943080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04741","snapshot_observed_at":"2026-08-01T14:53:35.432279Z","title":"When bad data leads to good models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18639","last_updated":"2026-07-21T02:15:39Z","snapshot_observed_at":"2026-08-17T12:07:36.562632Z","submitted_at":"2026-07-21T02:15:39Z","title":"Mark, Don't Erase: Token Inoculation for Dual-Use Knowledge in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:53:35.432279Z"},"links":{"cited_paper":"/paper/2505.04741","citing_paper":"/paper/2607.18639"},"observation_digest":"sha256:fd7c714db964de13f05ff6a0dfe3d54c06ac25916802b689bae83d638a49a3be","observation_id":"e0b15acf-3aab-4fff-a4fe-63fb8b27140c","resolution":{"observed_at":"2026-08-01T14:53:35.432279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.04741/citation-record","integrity":"/paper/2505.04741/integrity","json":"/paper/2505.04741/citation-record.json","paper":"/paper/2505.04741"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.094915Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.094915Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:2f07e144dd55f346c83a190d7f9d64f25fe083d60cc10cc3a86e5c08e7b86881","observation_id":"b2f95a0d-c763-4d66-8f47-141e27d29ba2","resolution":{"observed_at":"2026-08-15T23:25:00.094915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-15T23:25:00.101334Z","title":"Understanding intermediate layers using linear classifier probes","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.101334Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:3ca403d6c09875464a21f58d7bc046df51dc2c0d53514309f3d37c96b23ae3c9","observation_id":"9bdaa413-5218-4268-b5ff-2d0900576d25","resolution":{"observed_at":"2026-08-15T23:25:00.101334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22587","last_updated":"2024-11-18T18:42:44Z","snapshot_observed_at":"2026-08-18T12:50:57.421840Z","submitted_at":"2024-10-29T23:00:05Z","title":"Toxicity of the Commons: Curating Open-Source Pre-Training Data","version":2},"cited_work":{"arxiv_id":"2410.22587","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.22587","snapshot_observed_at":"2026-08-15T23:25:00.862060Z","title":"Toxicity of the Commons: Curating Open-Source Pre-Training Data","venue":"cs.CL","work_id":"2d4f0950-ec1c-4c18-9ad5-f61387b5f022","year":2024},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.107667Z"},"links":{"cited_paper":"/paper/2410.22587","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:5d916909729cb01b0c4cd96b83377971ed063c43af8f7161db450b18fb988a70","observation_id":"2100cedd-d90d-4a1f-b140-cbeec05e5e12","resolution":{"observed_at":"2026-08-15T23:25:00.868858Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.170356Z","title":"Linear algebraic structure of word senses, with applications to polysemy","venue":null,"work_id":"035b81d7-fc6a-40c2-9439-266e28cf2bf9","year":2018},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.112803Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:80ca102a2b5753a68c73c0303a551456dbb6fcd2f302b00bfa441be3365246d4","observation_id":"f767017b-facc-44fd-86f7-3a7948583d22","resolution":{"observed_at":"2026-08-15T23:25:01.175216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.154052Z","title":"Probing classifiers: Promises, shortcomings, and advances","venue":null,"work_id":"0c9a87bc-aded-446d-8e20-71cea1afcf04","year":2016},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.117702Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:e84a5e0685ee2e2575361ee6f2052ae9ff02d6a7d4c2f8133fc1bd631fde1f2b","observation_id":"fb30460a-59c5-40c3-afbe-9aa3508beb6c","resolution":{"observed_at":"2026-08-15T23:25:01.159363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-08-14T11:50:41.917778Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-15T23:25:00.122413Z","title":"Eliciting latent predictions from transformers with the tuned lens","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.122413Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:e21ea01068c2a04f0b08ecd7312756162e15b5d3d5886e987c187bc590dda894","observation_id":"9c253f6a-d6c7-409c-b366-ed71761c567f","resolution":{"observed_at":"2026-08-15T23:25:00.122413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06554","last_updated":"2024-10-16T04:48:08Z","snapshot_observed_at":"2026-08-16T17:52:35.421530Z","submitted_at":"2024-10-09T05:17:08Z","title":"The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06554","snapshot_observed_at":"2026-08-15T23:25:00.127552Z","title":"The accuracy paradox in rlhf: When better reward models don't yield better language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.127552Z"},"links":{"cited_paper":"/paper/2410.06554","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:190523eff58213bb7deb82e3bce42780c9da24b3ccfe3cab080207fc24e06a7b","observation_id":"1b6646a1-61e8-4c26-881e-672a32d40197","resolution":{"observed_at":"2026-08-15T23:25:00.127552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-14T00:28:11.851309Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-15T23:25:00.133124Z","title":"Ultrafeedback: Boosting language models with scaled ai feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.133124Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:c788ba71dfd9326a6852f9888515005c676787666e88a030e423b139d29c291d","observation_id":"2caa96ed-3b17-4a01-ac18-57aa299bb531","resolution":{"observed_at":"2026-08-15T23:25:00.133124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-16T13:37:26.527260Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-15T23:25:00.138738Z","title":"Sparse autoencoders find highly interpretable features in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.138738Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:f9b1c59ddb51d73977853b0a7dc12cfd90018c84a9369379ec2f1af00410911b","observation_id":"a2a48bba-7454-4da2-9525-77d95eb0b4ec","resolution":{"observed_at":"2026-08-15T23:25:00.138738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02164","last_updated":"2020-03-03T05:33:49Z","snapshot_observed_at":"2026-08-13T14:14:59.271697Z","submitted_at":"2019-12-04T18:32:15Z","title":"Plug and Play Language Models: A Simple Approach to Controlled Text Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02164","snapshot_observed_at":"2026-08-15T23:25:00.143735Z","title":"Plug and play language models: A simple approach to controlled text generation","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.143735Z"},"links":{"cited_paper":"/paper/1912.02164","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:1b66bc742c3bbd67b66879e8ae21850df3d3ecfebb2746e8ab90b28350532273","observation_id":"fa169dbb-ccc3-4820-964d-67a11a660243","resolution":{"observed_at":"2026-08-15T23:25:00.143735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-08-16T21:36:28.067615Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-15T23:25:00.150012Z","title":"Toy models of superposition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.150012Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:73ea907e45cca6f2d95b4f4acb3aef533d41edb8b791c50c178a4d5669588bfb","observation_id":"4e032bdb-b0ca-41d5-bf95-6951b59003c9","resolution":{"observed_at":"2026-08-15T23:25:00.150012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.154504Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.154504Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:d9ec55681fb71da6e9fa9dbad91afe5a3f842d3c4e1299c6138bb064e91a6d65","observation_id":"54f300f0-9d0a-4c71-a5cb-a87b170d8f63","resolution":{"observed_at":"2026-08-15T23:25:00.154504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.159644Z","title":"Openwebtext corpus","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.159644Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:38b16e3a98048b6f3e2737b0a2796afa53ded61e5612ac5a680eb1d05b3ba351","observation_id":"6961c34a-9882-4e07-b1d2-36dfe273bbc1","resolution":{"observed_at":"2026-08-15T23:25:00.159644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-08-17T12:46:02.488423Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-15T23:25:00.164201Z","title":"Olmo: Accelerating the science of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.164201Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:644a94e50e989bc4e4d7bbbd8961cf95373ed75962a5af1fcd97b0af745f5807","observation_id":"9afb00c9-3290-4a60-8934-0424c6d12ea2","resolution":{"observed_at":"2026-08-15T23:25:00.164201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10964","last_updated":"2020-05-05T22:00:44Z","snapshot_observed_at":"2026-08-17T15:18:00.337430Z","submitted_at":"2020-04-23T04:21:19Z","title":"Don't Stop Pretraining: Adapt Language Models to Domains and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10964","snapshot_observed_at":"2026-08-15T23:25:00.169716Z","title":"Don't stop pretraining: Adapt language models to domains and tasks","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.169716Z"},"links":{"cited_paper":"/paper/2004.10964","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:2bd544443633274e8f97ff81126d3cfe1ed6984443e5e4b9b9492b180907ea79","observation_id":"ac0b6d1e-efde-43e6-9c69-4ecd9902cf7c","resolution":{"observed_at":"2026-08-15T23:25:00.169716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.175329Z","title":"T oxi G en: A large-scale machine-generated dataset for adversarial and implicit hate speech detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.175329Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:ffd9884231b8f710ab3ab7c70fbd4588cca39decec45f13fab380529df250d43","observation_id":"8547cafb-0b5f-4792-8aff-180dfcbc10d8","resolution":{"observed_at":"2026-08-15T23:25:00.175329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-15T23:25:00.180719Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.180719Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:5b36333e7d250ea68593d0b93b1eb009cc193413ca75cb0542585da0abcf1da3","observation_id":"a2e46bb3-c397-40f9-9707-44d402f05bdb","resolution":{"observed_at":"2026-08-15T23:25:00.180719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.126688Z","title":"Toxic comment classification challenge, 2018","venue":null,"work_id":"807740fd-4bc7-4e8e-94f1-512232239a42","year":2018},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.185733Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:e40d06b9f8055388d58f572bc017ab0ec4c89f94fea54230f6c29b0f95be4cfa","observation_id":"4b50b71e-24ee-41c8-8840-109b107aec9f","resolution":{"observed_at":"2026-08-15T23:25:01.131842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05858","last_updated":"2019-09-20T20:08:56Z","snapshot_observed_at":"2026-08-19T21:50:02.108697Z","submitted_at":"2019-09-11T17:57:18Z","title":"CTRL: A Conditional Transformer Language Model for Controllable Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05858","snapshot_observed_at":"2026-08-15T23:25:00.191369Z","title":"Ctrl: A conditional transformer language model for controllable generation","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.191369Z"},"links":{"cited_paper":"/paper/1909.05858","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:4cb3af302ab02350a472dc80b338a3e54f4d5cd8ddbe8b2083d304e225ab846a","observation_id":"bba9cde2-5b94-4b39-a4af-73f468a71afc","resolution":{"observed_at":"2026-08-15T23:25:00.191369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06452","last_updated":"2024-02-19T14:39:07Z","snapshot_observed_at":"2026-08-14T15:51:49.712613Z","submitted_at":"2023-10-10T09:25:44Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06452","snapshot_observed_at":"2026-08-15T23:25:00.196576Z","title":"Understanding the effects of rlhf on llm generalisation and diversity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.196576Z"},"links":{"cited_paper":"/paper/2310.06452","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:23029a9a5381fab2cdeca7f300579f9280763ba5b4cf4e299df4a3dfd4057069","observation_id":"70ac03cd-a255-48bc-80fe-72e4d5369f55","resolution":{"observed_at":"2026-08-15T23:25:00.196576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06367","last_updated":"2020-10-22T14:14:09Z","snapshot_observed_at":"2026-08-07T21:01:20.443312Z","submitted_at":"2020-09-14T17:45:36Z","title":"GeDi: Generative Discriminator Guided Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06367","snapshot_observed_at":"2026-08-15T23:25:00.201730Z","title":"Gedi: Generative discriminator guided sequence generation","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.201730Z"},"links":{"cited_paper":"/paper/2009.06367","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:b89b0da21d296d6c6e6b92ecece6753e9216629139abb7e4e2fc0ad4792f807a","observation_id":"e469645b-796e-4199-9f17-d2c0fa4f5858","resolution":{"observed_at":"2026-08-15T23:25:00.201730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01967","last_updated":"2024-01-03T20:26:15Z","snapshot_observed_at":"2026-08-17T18:12:04.632625Z","submitted_at":"2024-01-03T20:26:15Z","title":"A Mechanistic Understanding of Alignment Algorithms: A Case Study on DPO and Toxicity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01967","snapshot_observed_at":"2026-08-15T23:25:00.206648Z","title":"A mechanistic understanding of alignment algorithms: A case study on dpo and toxicity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.206648Z"},"links":{"cited_paper":"/paper/2401.01967","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:e770e89b32e9814c63861dade012f6c8b9c467b09c746346736c2f4149959eca","observation_id":"2c6085e7-949a-426e-a80e-86e932d435e9","resolution":{"observed_at":"2026-08-15T23:25:00.206648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.110188Z","title":"Inference-time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":"408c4f0f-214f-4caa-96ef-c4f2a8ce8946","year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.211713Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:46d244e192b410c45aca16793f5beb2db276b6d8c935e64efb0218f1a30b2ed4","observation_id":"368755d9-9af7-4597-a1c6-31321658284f","resolution":{"observed_at":"2026-08-15T23:25:01.115476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.15097","last_updated":"2023-07-10T06:08:55Z","snapshot_observed_at":"2026-08-18T17:10:17.670255Z","submitted_at":"2022-10-27T00:58:21Z","title":"Contrastive Decoding: Open-ended Text Generation as Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.15097","snapshot_observed_at":"2026-08-15T23:25:00.216849Z","title":"Contrastive decoding: Open-ended text generation as optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.216849Z"},"links":{"cited_paper":"/paper/2210.15097","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:3b4e787406462b582f3012059a9d369fa23629aa5489c0f8cdf43c0b77b9ea79","observation_id":"abf2596f-f907-4d30-bece-f075c645a25a","resolution":{"observed_at":"2026-08-15T23:25:00.216849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.093922Z","title":"Disentangling transformer language models as superposed topic models","venue":null,"work_id":"3ea813c2-59a7-4a94-a0b7-44df7b078a61","year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.222381Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:8cffc58a9812704c20d30b6836baf07b26e58eff5ffc1481ac592bda8fb6c786","observation_id":"3b41d7ef-1f55-44ad-be48-c5cb2954f73f","resolution":{"observed_at":"2026-08-15T23:25:01.099144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06256","last_updated":"2024-10-13T19:27:20Z","snapshot_observed_at":"2026-08-19T06:38:08.890210Z","submitted_at":"2023-09-12T14:16:54Z","title":"Mitigating the Alignment Tax of RLHF","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06256","snapshot_observed_at":"2026-08-15T23:25:00.228033Z","title":"Speciality vs generality: An empirical study on catastrophic forgetting in fine-tuning foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.228033Z"},"links":{"cited_paper":"/paper/2309.06256","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:b2230f9800610366fb08ba092c0ae342e90f66a710f5e7c6f83b8c3a7898e400","observation_id":"97e1c1e6-4f9b-4150-bf1d-582a8b7ebae1","resolution":{"observed_at":"2026-08-15T23:25:00.228033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.03023","last_updated":"2021-06-03T05:26:11Z","snapshot_observed_at":"2026-08-20T01:12:58.663180Z","submitted_at":"2021-05-07T01:19:38Z","title":"DExperts: Decoding-Time Controlled Text Generation with Experts and Anti-Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.03023","snapshot_observed_at":"2026-08-15T23:25:00.233785Z","title":"Dexperts: Decoding-time controlled text generation with experts and anti-experts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.233785Z"},"links":{"cited_paper":"/paper/2105.03023","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:af184ec59fd1482e0845159263cfa637a58a8f9b73b2da7dd97a4c69ae1bc78b","observation_id":"0c6791db-f08a-4e44-825b-e5ef10f89236","resolution":{"observed_at":"2026-08-15T23:25:00.233785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.077639Z","title":"Amd-olmo: A series of 1b language models trained from scratch by amd on amd instinct™ mi250 gpus., October 2024","venue":null,"work_id":"ea93d0b2-3d7f-4f96-9ed5-5b4d6fdeef66","year":2024},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.239167Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:264d7d9ebfe46fca53e49c1443129f243f26fa69c7e0e2f67b9154f08fdcfdcf","observation_id":"c5157de0-8165-48ab-a585-33bab035de6d","resolution":{"observed_at":"2026-08-15T23:25:01.082439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13169","last_updated":"2023-11-13T14:50:06Z","snapshot_observed_at":"2026-08-20T03:20:03.635456Z","submitted_at":"2023-05-22T15:57:53Z","title":"A Pretrainer's Guide to Training Data: Measuring the Effects of Data Age, Domain Coverage, Quality, & Toxicity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13169","snapshot_observed_at":"2026-08-15T23:25:00.244162Z","title":"A pretrainer's guide to training data: Measuring the effects of data age, domain coverage, quality, & toxicity","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.244162Z"},"links":{"cited_paper":"/paper/2305.13169","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:ff7d02a5a2a7d81ef62f86b71e68f94d64f8abaf3a5ae776cebd8274c619d208","observation_id":"c76c5b64-8033-4efa-ade9-0d5460a3e08b","resolution":{"observed_at":"2026-08-15T23:25:00.244162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.062083Z","title":"On linear representations and pretraining data frequency in language models","venue":null,"work_id":"a03720f9-6850-4960-939a-442d2d45b272","year":2025},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.249536Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:b89b32357f54d09151b51529964c318e18c0cddcf14be06bb2da4cb2a1812da9","observation_id":"53856e84-5eda-4652-8888-4b64f1baa7d7","resolution":{"observed_at":"2026-08-15T23:25:01.066997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.254124Z","title":"Linguistic regularities in continuous space word representations","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.254124Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:988ad1ef68d01d53e7c1b69871912d237fdae9fd7228eca9ec3b01533ecf940f","observation_id":"8224ebc5-700f-4a65-9cc8-343bae33333d","resolution":{"observed_at":"2026-08-15T23:25:00.254124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.034925Z","title":"Interpreting gpt: The logit lens","venue":null,"work_id":"f17265c0-4c42-4597-ab89-da37056f7c96","year":2020},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.259048Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:c6ea01afdbd563ab550a6ac8fbc036ebebd1577bf6cf14e66cbbd3790777a05f","observation_id":"44aa07b2-1ef2-42b2-af50-a93b04dabbb5","resolution":{"observed_at":"2026-08-15T23:25:01.039903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.264005Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.264005Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:bb93410847ccea345825093cddddf0720a51ed1bc3deff1534b74c8127dce8f7","observation_id":"613c008c-b05a-4f10-b2ad-5de148c0d92b","resolution":{"observed_at":"2026-08-15T23:25:00.264005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:01.008600Z","title":"Raiders of the lost kek: 3.5 years of augmented 4chan posts from the politically incorrect board","venue":null,"work_id":"4a7c8bc5-8e66-4980-aea6-7dee68406a67","year":2020},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.268529Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:9c3d7be3d5fb2466b4baf4c9e7e201757864bdf4b5ee0219c1b7fec508d0ed1f","observation_id":"f1188968-aaab-47db-9d52-c217652598ea","resolution":{"observed_at":"2026-08-15T23:25:01.014366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.273439Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.273439Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:123d865c81cecca6f63c13256c85710163455e8a58213c0182e19a17bd1ab47b","observation_id":"913bea3b-fdc1-4e18-ab57-ed3e00371e55","resolution":{"observed_at":"2026-08-15T23:25:00.273439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-08-16T23:25:38.049210Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-15T23:25:00.278006Z","title":"The linear representation hypothesis and the geometry of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.278006Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:851d44bb740d29c09d8af837c81aa965b2484d63a95d4464fe0e6c62b69718a4","observation_id":"854dec26-189e-492c-ab36-e59efe142155","resolution":{"observed_at":"2026-08-15T23:25:00.278006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.982913Z","title":"Perspective | developers, 2024","venue":null,"work_id":"8d174d83-9025-41af-a64e-c3b4a08b1cfe","year":2024},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.283369Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:1aa38de2fe27a616f02a27b88ca945fdf6ebb5173acf997ed0b1c61d578bcbcc","observation_id":"175f1564-f108-4308-8292-d22005c637e2","resolution":{"observed_at":"2026-08-15T23:25:00.987592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07388","last_updated":"2023-02-14T23:00:42Z","snapshot_observed_at":"2026-08-16T15:55:17.483889Z","submitted_at":"2023-02-14T23:00:42Z","title":"Adding Instructions during Pretraining: Effective Way of Controlling Toxicity in Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07388","snapshot_observed_at":"2026-08-15T23:25:00.288445Z","title":"Adding instructions during pretraining: Effective way of controlling toxicity in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.288445Z"},"links":{"cited_paper":"/paper/2302.07388","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:0be3efba10de398c0bf4498a8447c2051727cae68b78468a1cb9e1b8979c866a","observation_id":"bce706af-0f82-4858-ac05-332473f85003","resolution":{"observed_at":"2026-08-15T23:25:00.288445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-15T23:25:00.293454Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to! arXiv preprint arXiv:2310.03693, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.293454Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:b1cb36d26612dffd3b3e12270626f2501ff12ce2e0088eaeb6d79232990d4657","observation_id":"91e7ccab-ec8a-4cab-8642-5dc0d9ae08ff","resolution":{"observed_at":"2026-08-15T23:25:00.293454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-08-09T14:52:01.161814Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-15T23:25:00.298525Z","title":"Rae, Sebastian Borgeaud, Trevor Cai, Katie Millican, Jordan Hoffmann, Francis Song, John Aslanides, Sarah Henderson, Roman Ring, Susannah Young, et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.298525Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:d45a77ddb367e07f22687965ff761d202ae0bf24307f6bd2c3b39a2d4e44b6c6","observation_id":"916a22c0-021b-4236-bbf6-d9106ec40964","resolution":{"observed_at":"2026-08-15T23:25:00.298525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-15T23:25:00.303571Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.303571Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:46e10eb903b3411d21d27c5e12346c620e68243a7a422f973a669005bfcbe568","observation_id":"cae6ff8d-8afd-4467-8cf0-e156b2b961c5","resolution":{"observed_at":"2026-08-15T23:25:00.303571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.308538Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.308538Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:1f018b4b7f77fc355d7f8a949b6fffa432c1cc9c686bf4abf36a09b0f33cfe00","observation_id":"ee09727c-4ae3-466c-9222-be2923d71879","resolution":{"observed_at":"2026-08-15T23:25:00.308538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.313458Z","title":"Self-diagnosis and self-debiasing: A proposal for reducing corpus-based bias in nlp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.313458Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:e7dc4e6c61d04945beb9ae092a005d3049efceb2af2a55ad2c1fdf1d6d734e22","observation_id":"ac047372-dd4c-4781-aff0-ebee555c821e","resolution":{"observed_at":"2026-08-15T23:25:00.313458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.947147Z","title":"Process for adapting language models to society (palms) with values-targeted datasets","venue":null,"work_id":"8eb64d0f-f6d8-4675-8957-fa9e1a1d374e","year":2021},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.318335Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:27cd557af81d32a12ff51bb82070763e0392432fa877fbd0128517516ec65619","observation_id":"7a8d70f4-356e-4be9-9c0c-1799478091f9","resolution":{"observed_at":"2026-08-15T23:25:00.952087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.05950","last_updated":"2019-08-09T15:51:47Z","snapshot_observed_at":"2026-08-20T04:51:51.539700Z","submitted_at":"2019-05-15T05:47:23Z","title":"BERT Rediscovers the Classical NLP Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.05950","snapshot_observed_at":"2026-08-15T23:25:00.322982Z","title":"Bert rediscovers the classical nlp pipeline","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.322982Z"},"links":{"cited_paper":"/paper/1905.05950","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:3953e858dc49e75f711df38c819eadea93f4c0ef09b9c3f0991542a21f4f0172","observation_id":"3e9390c6-1218-43ac-8444-0c8c4253a16d","resolution":{"observed_at":"2026-08-15T23:25:00.322982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-15T23:25:00.327735Z","title":"Lamda: Language models for dialog applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.327735Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:05278a00899450fb2f3557d35a7b865293d6f426247693ce19ec07319f19c4e2","observation_id":"9dd612bc-acd7-4ed1-b92a-2794c86064c5","resolution":{"observed_at":"2026-08-15T23:25:00.327735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.931143Z","title":"Activation addition: Steering language models without optimization","venue":null,"work_id":"15bc66d2-fba8-4c0d-a836-9eced9e19075","year":2023},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.332669Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:b42aeefe76a77a5e4a5aac6e289521668f57a6bbf5b3b1ab659a0c8754219d31","observation_id":"c966ef15-db07-43ee-bc29-deb4faecc115","resolution":{"observed_at":"2026-08-15T23:25:00.936145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.914029Z","title":"Exploring the limits of domain-adaptive training for detoxifying large-scale language models","venue":null,"work_id":"917e65c7-308f-4f8a-bb19-e11f23764000","year":2022},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.337413Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:2a19b77ad365b7b29cba46804044158bd36cfe772f1b457cec328216bfff046d","observation_id":"e6672175-a16e-4f4e-a20f-4891429806aa","resolution":{"observed_at":"2026-08-15T23:25:00.919423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00746","last_updated":"2024-06-18T13:08:24Z","snapshot_observed_at":"2026-08-19T12:40:58.780256Z","submitted_at":"2023-10-01T17:52:59Z","title":"RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00746","snapshot_observed_at":"2026-08-15T23:25:00.342165Z","title":"Rolellm: Benchmarking, eliciting, and enhancing role-playing abilities of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.342165Z"},"links":{"cited_paper":"/paper/2310.00746","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:bec7546e551d401c035404431c6943f04fc2b5f9f69d0b82a60a29b9f8270c52","observation_id":"0ecbe4bc-f605-430b-9d7a-5a799b4d55b0","resolution":{"observed_at":"2026-08-15T23:25:00.342165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:25:00.897119Z","title":"Lower bounds on the maximum cross correlation of signals (corresp.)","venue":null,"work_id":"5de35329-5c9e-4353-8df7-22bc8d6ea85c","year":2003},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.347057Z"},"links":{"citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:4640edfed2932cb5b393ef8db3d24d4d7ed3a496194ca1987f107d4e7ab0a7a9","observation_id":"8e445eca-790a-49e6-87db-cbb605393df2","resolution":{"observed_at":"2026-08-15T23:25:00.902623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-15T23:25:00.352149Z","title":"Representation engineering: A top-down approach to ai transparency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T23:25:00.352149Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2505.04741"},"observation_digest":"sha256:e83fadeba78b9090d8a803ab9edcab17bb17282cacdf4c43d6646c0d2e7ecd20","observation_id":"6c75294e-4f85-42b7-9b59-344afc331f98","resolution":{"observed_at":"2026-08-15T23:25:00.352149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.04741","last_updated":"2025-05-07T19:17:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T12:50:37.530871Z","submitted_at":"2025-05-07T19:17:49Z","title":"When Bad Data Leads to Good Models"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 2 inbound Pith citation observations for arXiv:2505.04741."}