{"as_of":"2026-08-12T05:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd183a1f44b299f1ad22b2b5d125084b1a9a37f0685131fd0dc61c296e84b99a","coverage":[{"denominator":193,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:36:58.802066Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07594/citation-record","integrity":"/paper/2608.07594/integrity","json":"/paper/2608.07594/citation-record.json","paper":"/paper/2608.07594"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.408229Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.408229Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:84c1994ba473a3d064b9bb9fa00923e32eb8a2c8def353149789b3d357fd8ee3","observation_id":"899a6c02-aea0-4c89-abd3-6cb70d86a9b1","resolution":{"observed_at":"2026-08-11T00:36:58.408229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.413252Z","title":"Second Conference on Language Modeling , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.413252Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:03e2c3d0508ef046c6465603edf23e1cbaa668af2decba6cdf69bcad21c73fce","observation_id":"52877553-34d2-4ca8-bf41-a058a7253f7b","resolution":{"observed_at":"2026-08-11T00:36:58.413252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.417476Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.417476Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:6ea512989e2a57539f4939aa8aceabf508a53eee161f664b1a269c6c8cc1022c","observation_id":"085065e1-099c-4e17-8457-ded134ea55f8","resolution":{"observed_at":"2026-08-11T00:36:58.417476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02164","last_updated":"2020-03-03T05:33:49Z","snapshot_observed_at":"2026-08-09T12:15:11.395844Z","submitted_at":"2019-12-04T18:32:15Z","title":"Plug and Play Language Models: A Simple Approach to Controlled Text Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02164","snapshot_observed_at":"2026-08-11T00:36:58.422205Z","title":"arXiv preprint arXiv:1912.02164 , year=","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.422205Z"},"links":{"cited_paper":"/paper/1912.02164","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:edd41caf96695d494b75a33f4d73da49718da2af5caf9f824852e1ec4e2571bf","observation_id":"5ea2baa5-71d3-486a-99d1-f55881eaa259","resolution":{"observed_at":"2026-08-11T00:36:58.422205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.427272Z","title":"Findings of the Association for Computational Linguistics: ACL 2022 , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.427272Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a124d73db40e36fe0bb9aa0458ee6e53e7950d72cb8d9494d53c2d9389022a9c","observation_id":"6b5f2e08-efe2-4754-a9b0-b66917c11fbe","resolution":{"observed_at":"2026-08-11T00:36:58.427272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.431357Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.431357Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:4f1e0f290d5195b9e0e9367473ef20e9cf5bf9e3cab29011ebf20a3d5a543858","observation_id":"3e59a8e6-c1a6-4fef-a503-afb46f29decb","resolution":{"observed_at":"2026-08-11T00:36:58.431357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-11T00:36:58.435669Z","title":"arXiv preprint arXiv:1803.05457 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.435669Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:20d90948d57a9d090e47ee51292818b739b272434fa0a8797a8163ccb6542eec","observation_id":"db515cd9-c51c-40c5-86a0-e3928f769054","resolution":{"observed_at":"2026-08-11T00:36:58.435669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.440553Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.440553Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:357ab1bfcd07dd8c90db9fd6e1d95cd9deed430360537d479148c4c2f31cb62f","observation_id":"d10e44d3-54fc-44f3-b888-2d4f4fb20e48","resolution":{"observed_at":"2026-08-11T00:36:58.440553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.444868Z","title":"Communications of the ACM , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.444868Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7b6771a9de0f65330deb1116e75d6dab6de628b012454834ee7f862e3af42897","observation_id":"2a4e0fcd-015e-4ec3-b572-ec2a278b8eb4","resolution":{"observed_at":"2026-08-11T00:36:58.444868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-11T00:36:58.448874Z","title":"arXiv preprint arXiv:2203.15556 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.448874Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:cd62619ada5e1792df32fcffec15b43d0cec45405bb91e77fc5206d024da71a6","observation_id":"0b549f49-adc4-4097-bc72-cd580e1db3db","resolution":{"observed_at":"2026-08-11T00:36:58.448874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01505","last_updated":"2024-12-02T13:58:35Z","snapshot_observed_at":"2026-08-12T04:15:38.580014Z","submitted_at":"2024-12-02T13:58:35Z","title":"Scaling Law for Language Models Training Considering Batch Size","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01505","snapshot_observed_at":"2026-08-11T00:36:58.453409Z","title":"arXiv preprint arXiv:2412.01505 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.453409Z"},"links":{"cited_paper":"/paper/2412.01505","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:903b07e2b3f3d463844a9382c8b26705d4cdf0890f144810d699b0144345bb6c","observation_id":"478ed296-a58f-4141-93c3-4df42f4a7c39","resolution":{"observed_at":"2026-08-11T00:36:58.453409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.459715Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2021 , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.459715Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:b55818c491f14a6e4b10d9b64a0472c9ed3389092ec0e9492ce2c55affb3aa7c","observation_id":"6dad12ec-1d7e-45fe-b822-5e1cd2738eb5","resolution":{"observed_at":"2026-08-11T00:36:58.459715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.463918Z","title":"Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.463918Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:b497e3732d134c18db8a11165fbdff031201e985186f505c2c88a113c2248165","observation_id":"2d3f982f-bc1b-419e-8e24-e9ce26595ab7","resolution":{"observed_at":"2026-08-11T00:36:58.463918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-11T00:36:58.468241Z","title":"arXiv preprint arXiv:2404.06395 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.468241Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:ff8884e2919244835d296b6f6f968d078cf03e11300a35114e2cc9c5306d033d","observation_id":"75935f09-d0e3-4a4c-8caa-ce0798f25d62","resolution":{"observed_at":"2026-08-11T00:36:58.468241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.472683Z","title":"arXiv preprint arXiv:2512.10858 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.472683Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:57c5e2b3e96a7a40933b8edfc03af0761dbf43b77369f78af53808748c39273a","observation_id":"29c571e1-95e2-49f5-936e-90d9a605d49d","resolution":{"observed_at":"2026-08-11T00:36:58.472683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T00:36:58.476461Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.476461Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:c277868154859390e27dea30a4df0def167f126e6d3613d74768261f8fe16957","observation_id":"97d01b97-159d-4b1d-b016-25632a6c467c","resolution":{"observed_at":"2026-08-11T00:36:58.476461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.480784Z","title":"arXiv preprint arXiv:2510.03280 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.480784Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:ade9ed017505873930ecc3e58b4b73ea93b501f0bb02b8bb094a7cdaf005d1d8","observation_id":"079b6332-98d0-408c-82f6-72a41eabf690","resolution":{"observed_at":"2026-08-11T00:36:58.480784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18514","last_updated":"2025-02-28T07:02:59Z","snapshot_observed_at":"2026-08-06T04:06:21.906356Z","submitted_at":"2024-10-24T08:01:22Z","title":"Scaling up Masked Diffusion Models on Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18514","snapshot_observed_at":"2026-08-11T00:36:58.484651Z","title":"arXiv preprint arXiv:2410.18514 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.484651Z"},"links":{"cited_paper":"/paper/2410.18514","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:9e73ae1d9396c0008fb4076fadc404cc921d0eade3aefab6451c3cc7156d5ab1","observation_id":"af9f02b3-3956-49f3-be39-db620d1fa309","resolution":{"observed_at":"2026-08-11T00:36:58.484651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.489110Z","title":"arXiv preprint arXiv:2602.15014 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.489110Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3666dc736986f4c0113957124ef8e9b069fd35e844d8c596b21120f1416c26dd","observation_id":"a463f431-8a28-4c79-bd22-12f6899be1f5","resolution":{"observed_at":"2026-08-11T00:36:58.489110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-10T17:03:38.042994Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-11T00:36:58.493093Z","title":"arXiv preprint arXiv:2401.02954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.493093Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:4070d8b090647d6d29cccef71d9a21a7d95005bb9d12c9eb93e750caf7dcba5b","observation_id":"1df9f4ae-55b2-442f-a961-1f9db316aff8","resolution":{"observed_at":"2026-08-11T00:36:58.493093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.497424Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.497424Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:0829db78e746f04eb3c5c8384344435a992e67ad20f3a42b6d7ac08720f986d9","observation_id":"903a6e47-ed2f-47eb-a97e-dd2f42b31203","resolution":{"observed_at":"2026-08-11T00:36:58.497424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.501845Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.501845Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:168f9a628ea331933b2bc3c5cc17c7f1f9c631fa6bed231cfa93008300d8653a","observation_id":"ae0ac5e3-69f9-4649-ac5c-466974253b26","resolution":{"observed_at":"2026-08-11T00:36:58.501845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.505801Z","title":"Proceedings of the 57th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.505801Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7f3fdde349dc4d2ff074f7bc89d0355cbf6f8e0980c2550c1f2037ac2e937ec6","observation_id":"1d5c753a-8796-4774-9e98-3f10b232938f","resolution":{"observed_at":"2026-08-11T00:36:58.505801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13314","last_updated":"2021-06-24T21:00:28Z","snapshot_observed_at":"2026-07-06T11:22:55.799017Z","submitted_at":"2021-06-24T21:00:28Z","title":"Promises and Pitfalls of Black-Box Concept Learning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13314","snapshot_observed_at":"2026-08-11T00:36:58.509740Z","title":"arXiv preprint arXiv:2106.13314 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.509740Z"},"links":{"cited_paper":"/paper/2106.13314","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a3432744a47671298b1cb452581dfe93512c8ee53fe07612044f2af6ee8151f3","observation_id":"c3d7b839-14d2-4cce-857d-831b2531fea3","resolution":{"observed_at":"2026-08-11T00:36:58.509740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04430","last_updated":"2025-02-10T19:55:17Z","snapshot_observed_at":"2026-08-06T22:57:40.145460Z","submitted_at":"2024-11-07T04:52:18Z","title":"Towards Unifying Interpretability and Control: Evaluation via Intervention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04430","snapshot_observed_at":"2026-08-11T00:36:58.513865Z","title":"arXiv preprint arXiv:2411.04430 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.513865Z"},"links":{"cited_paper":"/paper/2411.04430","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:c961f47fbf5fd5117bb05c0fe99ac26e9c37bf6eb9431a49010d54d5f479f09c","observation_id":"b8f3e0c2-2b8b-40eb-a641-d1e059477cf1","resolution":{"observed_at":"2026-08-11T00:36:58.513865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-10T14:49:08.398705Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-11T00:36:58.518062Z","title":"arXiv preprint arXiv:2501.17148 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.518062Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:d254c5082066bc03cb7bbd29a7ee4019cc765d3d5e5cd6f368bd9a619c16bf4e","observation_id":"3bc2e44e-d022-4b63-a352-5777f5fe446c","resolution":{"observed_at":"2026-08-11T00:36:58.518062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.521973Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.521973Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:efc86c703076b1d9297845fcd8ccbedc6b2c420ea519e16fe1902e315fa556e6","observation_id":"0a4f21ce-367d-43ba-b915-7ce80c664b95","resolution":{"observed_at":"2026-08-11T00:36:58.521973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.527038Z","title":"Proceedings of the 26th annual international conference on machine learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.527038Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:e7a37ca5f7dec86f51c5e506e7c3da34b17b506310b1570f64d9ddd03450b843","observation_id":"6a9bb90c-30c4-405f-b5c1-42e13b1eb16c","resolution":{"observed_at":"2026-08-11T00:36:58.527038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.530803Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.530803Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:fbeaa2e071e774790fec8a7c961d587438e834f187cceb6feb82b0ac504e5d75","observation_id":"4a6d3e80-7eb8-4b26-afcf-92ad88208119","resolution":{"observed_at":"2026-08-11T00:36:58.530803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.534395Z","title":"The annals of mathematical statistics , volume=","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.534395Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:964bf580008f150a7ffc29e96389eeb4ab8009fd9e263639c262dc7fb2901842","observation_id":"3dce6c8b-ff78-4a71-aad9-c2d53c720a81","resolution":{"observed_at":"2026-08-11T00:36:58.534395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.538441Z","title":"Journal of the Royal statistical society: series B (Methodological) , volume=","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.538441Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:284e2a0ae0648f90aa3657eabaf44f152f2331d06da4def54ccd40e5c5fb3035","observation_id":"c0d58aef-ce99-4354-8ba5-4406157b8cdb","resolution":{"observed_at":"2026-08-11T00:36:58.538441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.542295Z","title":"Journal of Pharmacokinetics and Biopharmaceutics , volume=","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.542295Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a492673bfb5fcc7b604b4a7faeadbaea350a460fcacfe6f5478aa6d7299d2927","observation_id":"76b464ac-de02-4b62-8dea-b4995282db05","resolution":{"observed_at":"2026-08-11T00:36:58.542295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.546296Z","title":"Social psychological and personality science , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.546296Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:c21ee8e8f89e5b130416b0749e737f2fbcf7ec2a9fe3d468fa9a2ff9634caa6e","observation_id":"87c673f3-484e-41f4-876b-fdd56a9e3915","resolution":{"observed_at":"2026-08-11T00:36:58.546296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T00:36:58.550005Z","title":"arXiv preprint arXiv:2303.08774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.550005Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:4c497486c82d7908f8a35240dadb0320da6a765e5821b22a484c800432c9861d","observation_id":"65707a35-9a21-48a3-a2e9-ec8fc5894cb9","resolution":{"observed_at":"2026-08-11T00:36:58.550005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.553873Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.553873Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:598ee10a4afe08aa21700e2a83e2551a29cfbfae3ebbaa8fb56788997d9e7e18","observation_id":"30100327-a4ba-4367-9f4e-45aa68bcbb23","resolution":{"observed_at":"2026-08-11T00:36:58.553873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-11T00:36:58.557843Z","title":"arXiv preprint arXiv:2403.08295 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.557843Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:64a6a7f4fca6a17b5f53c5e37618f9acd2f52689b4b229be610dfa6aea7957b0","observation_id":"7cb6ea1d-e746-41a0-8663-08cd272ee845","resolution":{"observed_at":"2026-08-11T00:36:58.557843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-11T00:36:58.561624Z","title":"arXiv preprint arXiv:2412.19437 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.561624Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3a578828a3a6b9de4e2c4f3dc68c356d075b1e5f71c29f46c73f043b6e9e68ec","observation_id":"5ca0c704-8be9-46b9-a512-d944156b4e85","resolution":{"observed_at":"2026-08-11T00:36:58.561624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.565605Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.565605Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a749f511e738e1c9b950d730912f6f5dc6c8a763c85415c7583ed4d750b8330d","observation_id":"32afe517-1ec2-4a2e-befc-73416e842d5e","resolution":{"observed_at":"2026-08-11T00:36:58.565605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-11T00:36:58.569296Z","title":"arXiv preprint arXiv:2312.11805 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.569296Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:cca47d1c49b5a3340bc9aa7d4e3da15889135e9454c999b9f28fde87f9914693","observation_id":"525d935d-1d4d-477d-8839-17c1c0a9d8ce","resolution":{"observed_at":"2026-08-11T00:36:58.569296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-11T00:36:58.573096Z","title":"arXiv preprint arXiv:2309.16609 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.573096Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:b0355699476836adca74f205b79a2a321230692c751acc416ac04a8ab72ad51b","observation_id":"a0819fbd-5904-4107-bf61-459d1e1d01f7","resolution":{"observed_at":"2026-08-11T00:36:58.573096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-11T00:36:58.576962Z","title":"arXiv preprint arXiv:2512.13961 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.576962Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:4908ad5f0bb128bd7e260ef2d586663f98f5a88ed2c0249d6114a5fd1863b19c","observation_id":"590d1a1f-897b-4705-a3ec-7be135aa7f54","resolution":{"observed_at":"2026-08-11T00:36:58.576962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.580956Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.580956Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a2c390f9ea2edddee57cddd7fdd4e53a7af18a6f0a4d7081ad3e978ae6cb2d3a","observation_id":"80e3cae1-ffc1-49b5-8936-ea230abf84a3","resolution":{"observed_at":"2026-08-11T00:36:58.580956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03736","last_updated":"2026-03-23T09:46:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T04:22:11Z","title":"Your Absorbing Discrete Diffusion Secretly Models the Conditional Distributions of Clean Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03736","snapshot_observed_at":"2026-08-11T00:36:58.584719Z","title":"arXiv preprint arXiv:2406.03736 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.584719Z"},"links":{"cited_paper":"/paper/2406.03736","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:78fb6202d9250787ec92c7ce2267511b94421d3405997236766510fc33821d35","observation_id":"8ca70d5b-8257-46e5-ad48-a9b7925a1994","resolution":{"observed_at":"2026-08-11T00:36:58.584719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.589024Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.589024Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:376dde0490dd0f301a84e4035b0dfe87bf130dd5107c366ab0be44921c286394","observation_id":"baa9b3b8-9dd5-4b0a-80d2-e0ae2e766926","resolution":{"observed_at":"2026-08-11T00:36:58.589024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.592837Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.592837Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:b31e16c5e18e6e28f999a3b717898db30dc6881ac16d18291ef4e2e38e7c400a","observation_id":"84f1f7f0-4b8b-44bc-b0a9-bc11cd23d88d","resolution":{"observed_at":"2026-08-11T00:36:58.592837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17298","last_updated":"2025-06-17T17:06:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T17:06:18Z","title":"Mercury: Ultra-Fast Language Models Based on Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17298","snapshot_observed_at":"2026-08-11T00:36:58.596715Z","title":"arXiv preprint arXiv:2506.17298 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.596715Z"},"links":{"cited_paper":"/paper/2506.17298","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:6861075c37713c0cb2f5c544edd64cf69c4c399e7b3e780b14b5901850d6868a","observation_id":"b6dccb48-b7da-4555-938c-55fcb7b673f2","resolution":{"observed_at":"2026-08-11T00:36:58.596715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02193","last_updated":"2025-08-04T08:43:01Z","snapshot_observed_at":"2026-07-06T22:07:21.387432Z","submitted_at":"2025-08-04T08:43:01Z","title":"Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02193","snapshot_observed_at":"2026-08-11T00:36:58.600729Z","title":"arXiv preprint arXiv:2508.02193 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.600729Z"},"links":{"cited_paper":"/paper/2508.02193","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:6905c047cec90f3b5605dfa1a0fe8418146e55cb9ec76fa281f570f5216337eb","observation_id":"2c886252-65aa-4f79-a719-3884e4b85aab","resolution":{"observed_at":"2026-08-11T00:36:58.600729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.604980Z","title":"Findings of the Association for Computational Linguistics: EACL 2026 , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.604980Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:22c1dcbdd209fe5cdf68de1185019e998ad2efa6c0833dcc09b7f7ef4ac5f098","observation_id":"2d99f286-db26-465a-9713-1c2293dd4d98","resolution":{"observed_at":"2026-08-11T00:36:58.604980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09573","last_updated":"2025-05-17T21:15:02Z","snapshot_observed_at":"2026-08-03T23:49:05.512328Z","submitted_at":"2025-03-12T17:43:40Z","title":"Block Diffusion: Interpolating Between Autoregressive and Diffusion Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09573","snapshot_observed_at":"2026-08-11T00:36:58.608734Z","title":"arXiv preprint arXiv:2503.09573 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.608734Z"},"links":{"cited_paper":"/paper/2503.09573","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:612a0cff1e21f6a53accf761345deca19dc77138df5748eab2a6e025bf7e64ca","observation_id":"1101566a-be80-4cfa-a8fc-c67c253531bd","resolution":{"observed_at":"2026-08-11T00:36:58.608734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-11T00:36:58.612743Z","title":"arXiv preprint arXiv:2209.10652 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.612743Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:9ed60c467be368c0eeb882ae07c3a4021ea9594b87f54d56a36b41346f8e9e0e","observation_id":"454e4a56-d4f8-48d8-8f80-d553c9061d31","resolution":{"observed_at":"2026-08-11T00:36:58.612743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.616782Z","title":"Transformer Circuits Thread , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.616782Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:1476482b125912b2b7d78444387f2d6884a9e1013082267c6d74e756e7f57f56","observation_id":"8e404870-a582-4641-84ca-9b11d60a4c3f","resolution":{"observed_at":"2026-08-11T00:36:58.616782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.620930Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.620930Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:c6abc8c2ad013ab89c67442bf399dd945cd4080b6ec814e6090c830bc95c45bc","observation_id":"0daabdb8-c5c6-4ad5-934a-5ebd1869ad48","resolution":{"observed_at":"2026-08-11T00:36:58.620930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.624686Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.624686Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:420507b3ec76ee36d15db6ba14f7ff7a5cb5f76a8099adadb22bd69c4ff39dc3","observation_id":"b158920a-768d-4ec0-b7e4-91ad927e0bc6","resolution":{"observed_at":"2026-08-11T00:36:58.624686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.628285Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.628285Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3f75c33b5f3da718a07e3cf56e78840e94404e46f6bc9f7ff8c8b92f8eec8239","observation_id":"e6b3f84b-5b01-4faa-8264-60592c32fc26","resolution":{"observed_at":"2026-08-11T00:36:58.628285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.632085Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.632085Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7a1a644844a93f5c28927873d1b6bfe6924d8eb6acdf932c52f292480da0aca4","observation_id":"dbbb0662-8aa5-4d39-a37e-301007a0e567","resolution":{"observed_at":"2026-08-11T00:36:58.632085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.635768Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.635768Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:77692553de47e6d58638330e95db850862b6475fc56e33ab4958aa9ca2bec381","observation_id":"38340329-2017-4565-998b-47227341bec3","resolution":{"observed_at":"2026-08-11T00:36:58.635768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.639387Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.639387Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:0f8983016d38e71526d0c50a3e650be403462f739b9ffb6255bb81994a448b08","observation_id":"6006fbfe-cbd7-4153-ae18-f9d77946bfb6","resolution":{"observed_at":"2026-08-11T00:36:58.639387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.642761Z","title":"arXiv preprint arXiv:2506.10892 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.642761Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:61fb54427355e53e5e59fcce8e704f43efd438886f23e2838781a1f5987e4e63","observation_id":"fa78121d-a5ff-4e02-8473-8fb17d9a5239","resolution":{"observed_at":"2026-08-11T00:36:58.642761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01928","last_updated":"2026-08-05T00:02:32Z","snapshot_observed_at":"2026-08-08T23:08:57.113826Z","submitted_at":"2025-06-02T17:47:27Z","title":"Esoteric Language Models: A Family of Any-Order Diffusion LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01928","snapshot_observed_at":"2026-08-11T00:36:58.646253Z","title":"arXiv preprint arXiv:2506.01928 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.646253Z"},"links":{"cited_paper":"/paper/2506.01928","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7062de9d5458f5dd5dbf81c62b18fb1e81793e75ec806b3b6603e863fded3309","observation_id":"1ac576a8-8784-445f-baac-83747506b7cb","resolution":{"observed_at":"2026-08-11T00:36:58.646253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-11T00:36:58.650247Z","title":"arXiv preprint arXiv:2308.10248 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.650247Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:6e53bb2ce7f3b287cfada28760a7046fc06c5721fa9a235a801206e6c53a05d1","observation_id":"eb76b229-a91c-4a0e-8cdf-e1f5beafa000","resolution":{"observed_at":"2026-08-11T00:36:58.650247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.653751Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.653751Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:1fa107df4f663db7e81f15354486a722f968383ea3060e7c320ee083431be0fa","observation_id":"02e3e126-6dfb-4780-ba3b-b0d09865e792","resolution":{"observed_at":"2026-08-11T00:36:58.653751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-11T00:36:58.657462Z","title":"arXiv preprint arXiv:1610.01644 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.657462Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:bba95b88b4c5eb5ab68622234b01a938989d8e5eb6b0ce3bc5b679275e09cefe","observation_id":"6199a7c6-f3f9-43f1-87b3-5993f0aed4b4","resolution":{"observed_at":"2026-08-11T00:36:58.657462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.661301Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.661301Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a93d76ad35a286736dd83dbf24345ea6cf133fc40a48bcd198134e549ba7f1a3","observation_id":"d165b11b-e838-4e6a-a0f4-13e512cdfc3a","resolution":{"observed_at":"2026-08-11T00:36:58.661301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-11T00:36:58.664963Z","title":"arXiv preprint arXiv:2310.01405 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.664963Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:213dd468415925f67be3c02ac8dd6f979fe9a5960884a5fd8f2abdaaa8cd2ce8","observation_id":"aac6f879-afe1-4e8e-9a30-c19fa1aef878","resolution":{"observed_at":"2026-08-11T00:36:58.664963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.668737Z","title":"2024 , publisher=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.668737Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:dfd6a2be9e501476d54da2710c47e876d04ac6430525fc6ad9b3e66301fcebf0","observation_id":"df021274-a922-4a5a-abaa-55f1f31c599f","resolution":{"observed_at":"2026-08-11T00:36:58.668737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.672355Z","title":"Nature machine intelligence , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.672355Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:5cda8fbcbcfd7f5634cbb776484f0576b1f2ba321321714905ffa1bae7c35ddf","observation_id":"d6efa557-2340-44d5-b633-cb5717f058e8","resolution":{"observed_at":"2026-08-11T00:36:58.672355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08608","last_updated":"2017-03-02T19:32:10Z","snapshot_observed_at":"2026-08-07T08:20:39.814613Z","submitted_at":"2017-02-28T02:19:20Z","title":"Towards A Rigorous Science of Interpretable Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08608","snapshot_observed_at":"2026-08-11T00:36:58.676160Z","title":"arXiv preprint arXiv:1702.08608 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.676160Z"},"links":{"cited_paper":"/paper/1702.08608","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3e2f03576e1294b7634ba966b9c8b89cc4fc5dba1b370592df303d2b34f842aa","observation_id":"848feaa0-1bc1-42f5-a9a1-c9f46a41d426","resolution":{"observed_at":"2026-08-11T00:36:58.676160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-11T00:36:58.680147Z","title":"arXiv preprint arXiv:2206.07682 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.680147Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:ae95913c85f9d4a6be6649b7a761c25a20f8b0edea62ea9a6fbdbe63475844ea","observation_id":"b6c6fd73-ce04-4543-a310-a108c9418fbe","resolution":{"observed_at":"2026-08-11T00:36:58.680147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.683999Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.683999Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:5a6b87122f772c4c67c2bd2963ebef0a2ccc90d51e5d79b9ea2f14a0b151b13b","observation_id":"d30eadff-ce37-48aa-ba9a-3432e53c5ccb","resolution":{"observed_at":"2026-08-11T00:36:58.683999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-11T00:36:58.687809Z","title":"arXiv preprint arXiv:2311.03658 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.687809Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:07d967c47fe6c65ecb3e35019ca2459d5934263a4c77d0bc130f5183f88aca09","observation_id":"ae64a33b-a5aa-44fa-90e2-d1043db9d9a6","resolution":{"observed_at":"2026-08-11T00:36:58.687809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.691731Z","title":"A is B” fail to learn “B is A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.691731Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:cef984e4e54d097ffd1d1c4be91a4c4f46ceff1099f5d326a16ecfb2de0a425a","observation_id":"d8b5769f-1a06-4a77-8d56-3dc529d796da","resolution":{"observed_at":"2026-08-11T00:36:58.691731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.695269Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.695269Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:955fc3572eb3085751ac15cd71451d586cc900385d48ded842eec3184ac4c3ca","observation_id":"01d05d4a-930a-41e6-9f52-2c9dfeb29d2a","resolution":{"observed_at":"2026-08-11T00:36:58.695269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.698865Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.698865Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3a04335eedf597ebe4f709d050576e91431ce008a7b15fe3fac7a708b516e7c6","observation_id":"d9447e02-9eff-4efd-8330-ce004eff61cb","resolution":{"observed_at":"2026-08-11T00:36:58.698865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.702709Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.702709Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:0b368746f0b2bae804b8aec9e390398d8b22cb1055ccf9ed19f08b099fb3b501","observation_id":"1a704b34-0cf7-40ba-aa20-9515d7d4b4df","resolution":{"observed_at":"2026-08-11T00:36:58.702709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.706599Z","title":"2023 , howpublished =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.706599Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:4a6dcdfacf8b3f799f48bf8a8c7320d83e53e74c6ddb92c3d943aa7166c0f727","observation_id":"fcd2e860-2383-4fae-9f76-26b36fdfd1f0","resolution":{"observed_at":"2026-08-11T00:36:58.706599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.710591Z","title":"GitHub repository , howpublished =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.710591Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:69032342fae2bb23cc5307ea79ff404cacc54007157c2682f507b5c2e2958542","observation_id":"28d33b06-5612-4c3f-a3bf-0a1ae97f534a","resolution":{"observed_at":"2026-08-11T00:36:58.710591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.714240Z","title":"Cryptographers’ track at the RSA conference , pages=","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.714240Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a7d924af68f569725c865fd724c274f1090c805ea3664155f8a97a6d39d930a6","observation_id":"d379ed9d-40e9-4ed0-b05d-a3727abf864b","resolution":{"observed_at":"2026-08-11T00:36:58.714240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.717873Z","title":"Scientific american , volume=","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.717873Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:15098e6574f0313fb2c3071ebf82b801b3678a82dbc97729c92bfe172974e11b","observation_id":"a052f412-de7e-46d2-a404-c2b007547174","resolution":{"observed_at":"2026-08-11T00:36:58.717873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-11T00:36:58.721501Z","title":"arXiv preprint arXiv:2305.06161 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.721501Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:2c2b464d5c7807124b9b46cda2440cecc3028a548c695f7487bb7811b09dbb97","observation_id":"9f1db654-54c4-4e63-8de9-36b011961aef","resolution":{"observed_at":"2026-08-11T00:36:58.721501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.725538Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.725538Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:ebb84af56d339d0348a99ec9bc437d5ebfa339545d77c82a4c0642bcca2cd4ec","observation_id":"2736c428-14f6-4fad-93ff-0b23159f7c34","resolution":{"observed_at":"2026-08-11T00:36:58.725538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.729330Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.729330Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:5f3d4f22b9d9f96395f3a7896bbe36be0054fef509da4636ec163145a260a069","observation_id":"5ef5289f-404e-4e4c-a7de-f61b7a4ade9b","resolution":{"observed_at":"2026-08-11T00:36:58.729330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-11T00:36:58.733264Z","title":"arXiv preprint arXiv:2310.10631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.733264Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:79bf81a18887975bb230df7afe1c9237b5e661679e748e2dc07ac94a710729eb","observation_id":"131490c0-125d-4de1-aaa4-374c5020ee55","resolution":{"observed_at":"2026-08-11T00:36:58.733264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.737069Z","title":"2026 , month =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.737069Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:c9ba5a5661b788edd5e55b5965538a3de8ce24187e9adfeff669f267f384b2b3","observation_id":"73076905-61b8-4ae0-a923-7b33142f40e3","resolution":{"observed_at":"2026-08-11T00:36:58.737069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.741065Z","title":"doi:10.5281/zenodo.12608602 , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.741065Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:20fd2ecd7234cae9c77ab4a8cd4402c710582f3c4d0955b72a2a37477e99fd84","observation_id":"6444b19e-7ad6-4ba1-98f8-179447161d04","resolution":{"observed_at":"2026-08-11T00:36:58.741065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-11T00:36:58.744657Z","title":"arXiv preprint arXiv:2101.00027 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.744657Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:d4b94adde253e1296cc0d4bfcfbebd08292e03631069d6662e20db0dcade795f","observation_id":"a8ef7112-9410-47b2-8161-794f5d024bfd","resolution":{"observed_at":"2026-08-11T00:36:58.744657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-11T00:36:58.748607Z","title":"arXiv preprint arXiv:2009.03300 , year=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.748607Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:2ba9b9bbb00cf2209d07466cfaa0f49f42c8350a3ca4d2407bbeb00bb67d4c17","observation_id":"70cbfe3c-6d8d-4dae-a25b-b96e87c86df5","resolution":{"observed_at":"2026-08-11T00:36:58.748607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.752584Z","title":"Nelson and Ku","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.752584Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:88d9ccd497ae8ac7e9bbb23ed46506d75bf7d621c0634fab7e783a9224a59be7","observation_id":"56c72ea9-33df-4243-b9b3-8eedf88c2933","resolution":{"observed_at":"2026-08-11T00:36:58.752584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.756401Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.756401Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:67657b51576b40ce5e34269b90a31259279328c78f1b40a16a274bf610147cc3","observation_id":"39cee7d0-d90f-4592-9302-958ec7223ddc","resolution":{"observed_at":"2026-08-11T00:36:58.756401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.760110Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.760110Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:f2c9bdb09b88f49b5cde92ae8fe53b54d982db9f26cd45c7cae6272b3566e305","observation_id":"8adc7414-1744-476a-a688-0649d09575a5","resolution":{"observed_at":"2026-08-11T00:36:58.760110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.763869Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.763869Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7413f4dd94d26d811e29093b564e3b6e942f83bf046552c1f4e53618f77281a1","observation_id":"946be5cf-e39c-48e3-b277-0129d85fc076","resolution":{"observed_at":"2026-08-11T00:36:58.763869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06129","last_updated":"2023-06-05T17:33:43Z","snapshot_observed_at":"2026-08-10T19:17:28.096908Z","submitted_at":"2023-04-12T19:27:09Z","title":"Label-Free Concept Bottleneck Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06129","snapshot_observed_at":"2026-08-11T00:36:58.767568Z","title":"arXiv preprint arXiv:2304.06129 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.767568Z"},"links":{"cited_paper":"/paper/2304.06129","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:06203880267265633b597a4a1789cb682136063c619e3aa62edf04ad585d8cc3","observation_id":"bcb0d6f2-3973-47b5-a8d3-b1df41fcc32b","resolution":{"observed_at":"2026-08-11T00:36:58.767568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.771826Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.771826Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:eb7154214ddb8be06ba3e61a40835c4956c20a0ce1fe78ea136f2db8939414cb","observation_id":"1d68cabd-83ea-418d-8302-009403e77ced","resolution":{"observed_at":"2026-08-11T00:36:58.771826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06068","last_updated":"2024-11-09T04:57:41Z","snapshot_observed_at":"2026-07-06T19:47:47.232714Z","submitted_at":"2024-11-09T04:57:41Z","title":"Zyda-2: a 5 Trillion Token High-Quality Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06068","snapshot_observed_at":"2026-08-11T00:36:58.775332Z","title":"arXiv preprint arXiv:2411.06068 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.775332Z"},"links":{"cited_paper":"/paper/2411.06068","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:b3ff0ea3dd231756f2c7176b53b675124278c5d5eaab63b5142d84067209a13c","observation_id":"06b14b64-3bb0-472d-94cd-163d1c10f23e","resolution":{"observed_at":"2026-08-11T00:36:58.775332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.779385Z","title":"Proceedings of the 58th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.779385Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:9e395cbc383d4be62d6c90dcafc3aa86ab7ddf5275a86f67c135391432462642","observation_id":"26626bd1-c9bc-4d3d-878a-039a6c37f7cf","resolution":{"observed_at":"2026-08-11T00:36:58.779385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.783239Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.783239Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:6175dd359a438ab953edf9da8324e9440c3df6f20c74fd06cfd13b8cbb6cf08e","observation_id":"ff63b0ee-f88b-4dab-b8cd-3cf1bd09aec0","resolution":{"observed_at":"2026-08-11T00:36:58.783239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T00:36:58.786983Z","title":"URL https://arxiv","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.786983Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7d03413f43e54bf421efcfc95901d46e115d68378d2866f6b8c4f726dc5792de","observation_id":"8174b139-d584-466b-984c-ccb5f03f7023","resolution":{"observed_at":"2026-08-11T00:36:58.786983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.790725Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.790725Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:be194060043bfbe274d4089cd7eed3d0d6bf4a468a9d2aeee8c659236e969018","observation_id":"d0daf3df-f185-45f5-a352-bb138a965296","resolution":{"observed_at":"2026-08-11T00:36:58.790725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.794361Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.794361Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:8da4d57e666bc850c582f75db1aec5a8c3b935e44abdb58cd20ce502f16b3ee4","observation_id":"79663dc9-0359-4c43-b18d-07a0d03956ff","resolution":{"observed_at":"2026-08-11T00:36:58.794361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-08-09T13:23:52.437582Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-11T00:36:58.797964Z","title":"arXiv preprint arXiv:2506.05176 , year=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.797964Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:d3f368dab6b704a372ce6650b46c7ffe6dc3eb5d90b94aad43a041b96f8ca16a","observation_id":"f7791534-b14a-417f-893b-bd4c6fc5e543","resolution":{"observed_at":"2026-08-11T00:36:58.797964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.802066Z","title":"IEEE transactions on big data , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.802066Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a115e6f28e67be85cf8d727563a5b1398a9342d4f74d0e9d76aaecb495d01de5","observation_id":"cfb6723d-d4a7-4d02-aff4-b2fe88f136a9","resolution":{"observed_at":"2026-08-11T00:36:58.802066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T05:15:09.763944Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":193},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 100 of 193 outbound references and 0 inbound Pith citation observations for arXiv:2608.07594."}