{"as_of":"2026-08-15T11:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ece2f138dd111b82ee42a281689721311873a58cc40bdb68eed23ad18df9e2d","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T02:17:22.722321Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25063/citation-record","integrity":"/paper/2607.25063/integrity","json":"/paper/2607.25063/citation-record.json","paper":"/paper/2607.25063"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-07-31T02:17:22.549469Z","title":"arXiv preprint arXiv:2001.08361 , year=","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.549469Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:18c95bd98b30280938fad7eef3373a0c8d32a337758123771b72cd9382f63b0e","observation_id":"a017cda5-df0e-40e7-9b51-eda191ef9aba","resolution":{"observed_at":"2026-07-31T02:17:22.549469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.555774Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.555774Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:aedbd8fe9f971ee7ee289b2f692a4b80eb9c143097ed1a8a014522702903dc8b","observation_id":"7de6ca48-fc67-445d-8173-cb625a657973","resolution":{"observed_at":"2026-07-31T02:17:22.555774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-07-31T02:17:22.559122Z","title":"arXiv preprint arXiv:2101.00027 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.559122Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:5a8d667b1277bf7271ceb4936947304f3f05e05312776ec0154bad8673a12f69","observation_id":"693794e0-756c-4284-a3d8-8c0678bbc84a","resolution":{"observed_at":"2026-07-31T02:17:22.559122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.562609Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.562609Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:4e8ad1f2e2fa8c7305943758f6a4882ad77f3f4c23c70e730a9c85a99212ee24","observation_id":"bf9bec91-edea-45d5-9941-18fcb656d76e","resolution":{"observed_at":"2026-07-31T02:17:22.562609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.565902Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.565902Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:0d26b391d5c2f71d8ca3637a5e034d4117f381a96908b03f95fdcf6728167152","observation_id":"8b98aae2-1e74-45c2-a202-1237ec16531a","resolution":{"observed_at":"2026-07-31T02:17:22.565902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.569365Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.569365Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:860ee274857e272fdf98befd484b6f8fb9803a5d519d44a3c964e792c8081a3d","observation_id":"0663d43e-6a84-438b-b175-2ebe0d253d4d","resolution":{"observed_at":"2026-07-31T02:17:22.569365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.572867Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.572867Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:2d5aa54eb18af0251ea2119fa20c1db794575570b4735b65fe9f2d38a04460f5","observation_id":"ef26de6e-c347-48c1-913b-295a52725e6a","resolution":{"observed_at":"2026-07-31T02:17:22.572867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.576162Z","title":"arXiv preprint arXiv:2603.16177 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.576162Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:ee86abf3b1243138e391bff03345ad4ec206b749dea93f18366e6df7ec92fc74","observation_id":"4430bee9-30df-4c1b-ab24-b7868f5468b4","resolution":{"observed_at":"2026-07-31T02:17:22.576162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12705","last_updated":"2026-08-09T17:20:04Z","snapshot_observed_at":"2026-08-13T23:28:04.404751Z","submitted_at":"2026-05-12T20:08:00Z","title":"Early Data Exposure Improves Robustness to Subsequent Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.12705","snapshot_observed_at":"2026-07-31T02:17:22.579554Z","title":"arXiv preprint arXiv:2605.12705 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.579554Z"},"links":{"cited_paper":"/paper/2605.12705","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:d2dda0c3e35374757fcacf84da27e7d38930e13346918d241942145aab2ccebb","observation_id":"2ca4cca7-6143-43b7-9043-b1af18142371","resolution":{"observed_at":"2026-07-31T02:17:22.579554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.583253Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.583253Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:1e6722e012af50f16f77baaaaded57e61d87d3dacc066e0363d9028396b852c1","observation_id":"e6b8d3c7-a61f-4d53-9427-7fc352265f2f","resolution":{"observed_at":"2026-07-31T02:17:22.583253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.586188Z","title":"Constitutional","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.586188Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:c6b5c5cdc136aeb5f000b4599e43f2dd6b319672138a49fad1b4442f7c1b51ce","observation_id":"a2e854f8-4aab-4a6c-88fe-c2f036d2cc92","resolution":{"observed_at":"2026-07-31T02:17:22.586188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.589438Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.589438Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:545711ae1d7e691f0e44d67fa457b2fa3d4886ba536ca530abfd5720236e0836","observation_id":"9b783277-afef-4725-b218-edf8447cf661","resolution":{"observed_at":"2026-07-31T02:17:22.589438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.592503Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.592503Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:c2c6a927ccd709d9de0a2b0cca54f743b988c45596b08893c00afb84e2e4f05b","observation_id":"151eaa9e-4f56-475d-b9ae-e77fbb544cb7","resolution":{"observed_at":"2026-07-31T02:17:22.592503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.595556Z","title":"Proceedings of the 41st International Conference on Machine Learning , articleno =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.595556Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:5ac699fa3512d5fd98f6798cce45f06450699f6299f259fdf7de2235b760171d","observation_id":"3f1a87db-3639-4d34-bd01-7daba77bc9b0","resolution":{"observed_at":"2026-07-31T02:17:22.595556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-15T06:02:45.207770Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-07-31T02:17:22.598889Z","title":"arXiv preprint arXiv:2502.14768 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.598889Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:4d0f90ba115807c3a8da3d2b50776e27a3b573d8210407f00666b4b480949908","observation_id":"7ed1b347-8401-4272-bde6-832c6c94af8a","resolution":{"observed_at":"2026-07-31T02:17:22.598889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.602190Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.602190Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:649afd0f2aaba139e47f6980f769d20355cee7d985ae6810c90c6eb525d2cceb","observation_id":"08552a79-d83d-4268-a07d-b6482d1147a7","resolution":{"observed_at":"2026-07-31T02:17:22.602190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-07-31T02:17:22.605460Z","title":"arXiv preprint arXiv:2307.15043 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.605460Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:8a578ce537634e482948cde1e8d6acd6f31e8539af7421c8228d4d557215bc98","observation_id":"506ccccb-2154-46e6-8a53-bbd342554085","resolution":{"observed_at":"2026-07-31T02:17:22.605460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.609047Z","title":"XST est: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.609047Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:4241c10763b49db7dedb18b9f6e19fb95163b16eea2c682c51b6ca0b14687c22","observation_id":"b089b126-a29d-491b-a4e4-5b826199a182","resolution":{"observed_at":"2026-07-31T02:17:22.609047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.612389Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.612389Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:06c3d488b8c032194110b2fd8f00f7e5a0cae856491b542e9dc7a5ccec9bcc55","observation_id":"d92f9899-399c-4df5-854e-a7bbb54b6da4","resolution":{"observed_at":"2026-07-31T02:17:22.612389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.615441Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.615441Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:4d6e80a30cc90061b96567fc6d316641f0f76d0ede638f8cc396fc437d804a3a","observation_id":"043496bb-c4a9-4242-b319-bed7dd58d8e9","resolution":{"observed_at":"2026-07-31T02:17:22.615441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.618898Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.618898Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:c801b8618bda0cd5612d451ac2538538125d355b14d1fedd4ba8341dbc32f9f6","observation_id":"9c4a539c-1d00-47ac-8d88-31973bdf4348","resolution":{"observed_at":"2026-07-31T02:17:22.618898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.621818Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.621818Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:2b6b0117c0ed7c056ab29324a5c60b176f0d5705fcb7c98a97d67c1efac2b648","observation_id":"7fb46ce0-fd34-4f4c-8e7d-537b2e746372","resolution":{"observed_at":"2026-07-31T02:17:22.621818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.625044Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.625044Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:a4e405a71bc293758bc7dd42519c9c06b964b001b55dcd8e99462fde16e61673","observation_id":"7aae149f-f1dc-4ffe-af76-106006939552","resolution":{"observed_at":"2026-07-31T02:17:22.625044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-07-31T02:17:22.627963Z","title":"arXiv preprint arXiv:2204.05862 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.627963Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:83b459d1e613286519bd2940ca509332153dad872119f25cf027fe27fe1548e5","observation_id":"95425667-b0f4-4911-bd19-de56338d7255","resolution":{"observed_at":"2026-07-31T02:17:22.627963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.630975Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.630975Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:2e71b63f1a6db2c5cfb6d8df118b22e74ba6476fc459cf1b463bdd85e305e3a6","observation_id":"ed7dc7ad-fc75-4f71-a0d8-2545cce8a2e8","resolution":{"observed_at":"2026-07-31T02:17:22.630975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.634113Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.634113Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:c530087c0ba7ea30a8df872366e99f61ad00c11e463c43469731e240ad19b954","observation_id":"7e1c07db-132b-431a-b4ab-7987881616ab","resolution":{"observed_at":"2026-07-31T02:17:22.634113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-31T02:17:22.637543Z","title":"arXiv preprint arXiv:1803.05457 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.637543Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:fca17bb73fabe812b9ca4ba861d05a1eed40cd9d5fb63ef73e75dcffa229d809","observation_id":"e6ee6d38-722d-49bf-baec-06890b6e7605","resolution":{"observed_at":"2026-07-31T02:17:22.637543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.640634Z","title":"2021 , publisher=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.640634Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:f8c7cac872064eba701fd48ed3a75b4af3e8913dd59a62d254e36454aa1158df","observation_id":"cd5f8ee0-a79e-4939-9c06-95fbdaebece4","resolution":{"observed_at":"2026-07-31T02:17:22.640634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-31T02:17:22.643531Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.643531Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:db83775fbcbe2aee7a004b82c6ed7f3be981160bf516879ce771d959af133919","observation_id":"522c6c56-00a1-4fe6-ae70-4fd13bca52a8","resolution":{"observed_at":"2026-07-31T02:17:22.643531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-08T06:58:44.493777Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-07-31T02:17:22.646936Z","title":"arXiv preprint arXiv:2501.00656 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.646936Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:fe2c44e6db7481b287b80cd3419cb32e153a85501e6d06e976cbcf801a8d58c6","observation_id":"9e99cc1b-85f8-4ef8-b5a6-0e8738036fc6","resolution":{"observed_at":"2026-07-31T02:17:22.646936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.650146Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.650146Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:521acec1fc71207157e631712689b73097c430da7c905a698923961763913c1a","observation_id":"1722050a-23af-44be-acb0-af7f87635e53","resolution":{"observed_at":"2026-07-31T02:17:22.650146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.653157Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.653157Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:31d13d32df52d9b31500ec07e4dab570a09d092a789278da541a006181d6b491","observation_id":"eaf029c5-f149-4594-b802-7d02f6fd0cc0","resolution":{"observed_at":"2026-07-31T02:17:22.653157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.656004Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.656004Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:afe4b713a7c4728fba80882f4bf933e6b9bf58e1ae0d17af6502b571b0612fc7","observation_id":"96e425a5-5712-4153-99e9-85cf537b3355","resolution":{"observed_at":"2026-07-31T02:17:22.656004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.659185Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.659185Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:6140aca646261cf99275e7b1a6ce1baac8df2086662e07a959b8084de3dad44b","observation_id":"fa6c10c0-0721-4734-9369-c464dd62f674","resolution":{"observed_at":"2026-07-31T02:17:22.659185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02841","last_updated":"2022-06-06T18:24:17Z","snapshot_observed_at":"2026-08-15T09:23:17.973040Z","submitted_at":"2022-06-06T18:24:17Z","title":"Researching Alignment Research: Unsupervised Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02841","snapshot_observed_at":"2026-07-31T02:17:22.662103Z","title":"arXiv preprint arXiv:2206.02841 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.662103Z"},"links":{"cited_paper":"/paper/2206.02841","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:904932c491267fd376dcf1ab432ab34f728cadac44846526c86634c13e81254e","observation_id":"5871ca10-dbf3-4100-973c-400b5e76cec3","resolution":{"observed_at":"2026-07-31T02:17:22.662103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.665077Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.665077Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:ac1ece29b96e3c95acbf45dd6076b36468957833d56aef81ef19153f342b02cd","observation_id":"57aa9629-a0c6-4f71-8db7-aa87d9be263e","resolution":{"observed_at":"2026-07-31T02:17:22.665077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.667950Z","title":"Findings of the association for computational linguistics: EMNLP 2020 , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.667950Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:752ed580d11a593036725922ca1d9bb870f557320f9379c4d406120f179b751a","observation_id":"225c1992-b2d7-4022-85c7-36b6b4f70fe1","resolution":{"observed_at":"2026-07-31T02:17:22.667950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.670820Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2023 , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.670820Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:02670a431737dca5e4dbb6e2e3a712c507a033da9efd3df3a849228becc74738","observation_id":"bad1bfd2-0b88-489c-91bb-568b3908683e","resolution":{"observed_at":"2026-07-31T02:17:22.670820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.673604Z","title":"Aligning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.673604Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:904288eb21c4297c02562cf7692ac992e109464911758070cc2c2a457c787a8b","observation_id":"c777d2ff-4d37-4f8b-b0fb-43a94a315687","resolution":{"observed_at":"2026-07-31T02:17:22.673604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.676849Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.676849Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:757753b66b893fef3ea7acd16b0bf626b6c8497b74f182e199fe41903f7bf86f","observation_id":"117591e9-ec13-4fb2-8b57-073c21886fcb","resolution":{"observed_at":"2026-07-31T02:17:22.676849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02087","last_updated":"2026-05-22T00:10:04Z","snapshot_observed_at":"2026-08-13T02:43:50.485814Z","submitted_at":"2026-05-03T23:16:14Z","title":"Model Spec Midtraining: Improving How Alignment Training Generalizes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.02087","snapshot_observed_at":"2026-07-31T02:17:22.679919Z","title":"arXiv preprint arXiv:2605.02087 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.679919Z"},"links":{"cited_paper":"/paper/2605.02087","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:0aff2d9cede3a04cb787922080a9ec582ca7dcd207f58eb5e68788d42226645a","observation_id":"693e832a-5de3-4c13-ae6d-378d262db937","resolution":{"observed_at":"2026-07-31T02:17:22.679919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-07-31T02:17:22.683124Z","title":"arXiv preprint arXiv:2311.07911 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.683124Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:cccc37ee6b35040db68ae6c7966858dc18e26d2625c75f3f7a29667074bfa39f","observation_id":"8a556665-a590-4f9e-93a8-3f53118fe5f2","resolution":{"observed_at":"2026-07-31T02:17:22.683124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.686221Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.686221Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:25ae7469120ca3e690a3276d20d68e2fb3932769ac8f769b93dbe6fe44958d3a","observation_id":"200cdfba-ffe3-4b01-8d78-a89e72cde748","resolution":{"observed_at":"2026-07-31T02:17:22.686221Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.689237Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.689237Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:8ee86af01cfef65cd258a20c2eead6318501df1988a078a17c13c940e4ddcf44","observation_id":"6d26df06-1b48-41ef-8852-0de2fc651fcb","resolution":{"observed_at":"2026-07-31T02:17:22.689237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.692274Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.692274Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:f781d2395030bc5adcf58f41b946e7607249e4d06cbb55e0ad1915b757680fd7","observation_id":"501a62a8-e6f5-4b7f-8ad7-c51fe2427d1c","resolution":{"observed_at":"2026-07-31T02:17:22.692274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.695296Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.695296Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:3050943fd3af51aec158dd62e42d2c3d7d2129aec97742890d171fbed61f2a15","observation_id":"45550689-fb79-4e38-be1f-4a110e429086","resolution":{"observed_at":"2026-07-31T02:17:22.695296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.698120Z","title":"Findings of the Association for Computational Linguistics: ACL 2023 , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.698120Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:d735f24c0a7bd5d94a1e6dcec556333a4aba45c1ea8854fc89d69e7b9dd576fd","observation_id":"03867213-9911-42d0-9d82-3f73af0687ff","resolution":{"observed_at":"2026-07-31T02:17:22.698120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.700943Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.700943Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:bb59174930667b37c2b0ea62f8cc0aac47811a7bf912cea13cf618f2fa507e53","observation_id":"1248bad9-b84d-4c77-9942-97b5daa5297c","resolution":{"observed_at":"2026-07-31T02:17:22.700943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.703918Z","title":"Zenodo , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.703918Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:c37fb62db0aa04b732706ccf2415c7e7a8aee81c3d8cc64a1d1756c3d2e1584c","observation_id":"c053dac0-e414-44d8-a643-860ac74963f8","resolution":{"observed_at":"2026-07-31T02:17:22.703918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.707201Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.707201Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:ced4d8d2dcaee5c49d44f1ea4c27a546255d6d5ce504a608f496c085ac85c052","observation_id":"ecefa553-4193-4a98-8e25-ce9f99e89c1c","resolution":{"observed_at":"2026-07-31T02:17:22.707201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.710267Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.710267Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:3e7b7d991c3d0d1e7ac87f5e717ec4f4d860a1213d5d27109d08af406dd63203","observation_id":"0c4d1232-2bcc-4c12-9b67-adfcfa9ed033","resolution":{"observed_at":"2026-07-31T02:17:22.710267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.713408Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.713408Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:488d8af4763a10093f92b5fc7eb5b7a624065a64a907db81df724d0e55f89b56","observation_id":"08fbf192-c69a-4b56-bfbe-432969869482","resolution":{"observed_at":"2026-07-31T02:17:22.713408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.716353Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.716353Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:db6149d76b66c6c3baa2b233f63ce29d932f16a4b780f832daa1b0df8ca8adda","observation_id":"a4faee45-8f7b-48b5-a646-1eb5f3244604","resolution":{"observed_at":"2026-07-31T02:17:22.716353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.719347Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.719347Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:944cdfe04b069270d3bbf0e50cd133c5693c858730ec9f319412bc94b7b4a95e","observation_id":"338fe9c2-5404-45a7-9541-5e26eb5e7735","resolution":{"observed_at":"2026-07-31T02:17:22.719347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T02:17:22.722321Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-31T02:17:22.722321Z"},"links":{"citing_paper":"/paper/2607.25063"},"observation_digest":"sha256:a1aaf8c075dbf3a47f294f63a0dbadda243e9706583375aaa9d9021a42ba3840","observation_id":"67494d31-016c-410d-ba14-546bd0c1382d","resolution":{"observed_at":"2026-07-31T02:17:22.722321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25063","last_updated":"2026-07-27T20:46:29Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T02:44:45.060958Z","submitted_at":"2026-07-27T20:46:29Z","title":"Similar Models Learn Differently: Final-Window Pretraining Shapes Post-Training Beyond SFT"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":54,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2607.25063."}