{"as_of":"2026-08-15T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6897dcc24ab19a4c4ea62a20eefe739e86eb7ccb7da3cda867a1fed4f1795798","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:39:09.218815Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:58:13.488639Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T13:03:26.399621Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10378","snapshot_observed_at":"2026-08-02T22:58:13.488639Z","title":"Discovering hierarchical latent capabilities of language models via causal representation learning.arXiv preprint arXiv:2506.10378,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.15327","last_updated":"2026-06-06T22:17:18Z","snapshot_observed_at":"2026-08-14T11:36:00.003257Z","submitted_at":"2026-02-17T03:13:51Z","title":"Prescriptive Scaling Reveals the Evolution of Language Model Capabilities","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T22:58:13.488639Z"},"links":{"cited_paper":"/paper/2506.10378","citing_paper":"/paper/2602.15327"},"observation_digest":"sha256:2763d692009cdcb53d0dbccca47a8508414390dba5f0b089979ffc9636c28c3a","observation_id":"b0f1d4cb-6768-449a-b1fc-34542ff1c298","resolution":{"observed_at":"2026-08-02T22:58:13.488639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"cited_work":{"arxiv_id":"2506.10378","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10378","snapshot_observed_at":"2026-06-29T13:03:26.399621Z","title":"Berivan Isik, Natalia Ponomareva, Hussein Hazimeh, Dimitris Paparas, Sergei Vassilvitskii, and Sanmi Koyejo","venue":null,"work_id":"871408b5-ec0d-475e-9b75-5f6174cb48b6","year":2024},"citing_paper":{"arxiv_id":"2605.28179","last_updated":"2026-05-27T09:01:09Z","snapshot_observed_at":"2026-08-05T14:49:49.141441Z","submitted_at":"2026-05-27T09:01:09Z","title":"SuperValid: Capability-Aligned OOD Validation for Generalizable Downstream Scaling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T12:57:31.313438Z"},"links":{"cited_paper":"/paper/2506.10378","citing_paper":"/paper/2605.28179"},"observation_digest":"sha256:4f99d994c6ca88f4f77da8121973dbaa522ee81bf962243a99d3623a29d0d934","observation_id":"65d6faf7-e7b7-4b4d-abb7-fedcd5281eae","resolution":{"observed_at":"2026-06-29T13:03:26.401147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10378","snapshot_observed_at":"2026-07-14T07:24:27.255815Z","title":"Discovering hierarchical latent capabilities of language models via causal representation learning.arXiv preprint arXiv:2506.10378,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11052","last_updated":"2026-07-13T03:31:03Z","snapshot_observed_at":"2026-08-14T17:32:20.941599Z","submitted_at":"2026-07-13T03:31:03Z","title":"Domain-Aware Scaling Laws Uncover Data Synergy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T07:24:27.255815Z"},"links":{"cited_paper":"/paper/2506.10378","citing_paper":"/paper/2607.11052"},"observation_digest":"sha256:91cf76e8e91464528d16982b26fc68f770fdaaeb522a5365f8739dc7fcefb781","observation_id":"b300a453-5410-4831-a99e-864932b4d533","resolution":{"observed_at":"2026-07-14T07:24:27.255815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10378/citation-record","integrity":"/paper/2506.10378/integrity","json":"/paper/2506.10378/citation-record.json","paper":"/paper/2506.10378"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:38:59.287822Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.287822Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:8f228ba8e7516983c91883f9912e27fcf44d8cb1c187a88f09cf5c118de53394","observation_id":"5b5eb337-be98-45fc-8e67-20706459c945","resolution":{"observed_at":"2026-08-07T04:38:59.287822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T04:38:59.369977Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.369977Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:33b8609753546b97fa3c9cda885bdb551f1ff22ff1e1c68223f2adc42f2bc9fd","observation_id":"2f156c47-68dc-435c-bd82-16a2dde1290e","resolution":{"observed_at":"2026-08-07T04:38:59.369977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:21.715684Z","title":"An integrated theory of the mind","venue":null,"work_id":"d0ffac85-c169-4267-917a-b3129b393a53","year":2004},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.507531Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:4644d9d5fe9d9ab7706c24875f166531d171b2e2a41caf68a92cc6d5347051d9","observation_id":"bc2b8b17-0cce-49d4-94c1-d35c8a2e4659","resolution":{"observed_at":"2026-08-07T04:39:21.826616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02893","last_updated":"2020-03-27T19:07:58Z","snapshot_observed_at":"2026-07-06T08:05:24.076802Z","submitted_at":"2019-07-05T15:26:26Z","title":"Invariant Risk Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02893","snapshot_observed_at":"2026-08-07T04:38:59.603495Z","title":"Invariant risk minimization","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.603495Z"},"links":{"cited_paper":"/paper/1907.02893","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1a34b9de84e6e59c2af9bf02c967d67f30e8059edc2c787f23153c85cb3ad26d","observation_id":"65b8ab84-64af-4b6d-8b25-5c2d766e2cc4","resolution":{"observed_at":"2026-08-07T04:38:59.603495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15936","last_updated":"2023-11-06T00:36:24Z","snapshot_observed_at":"2026-08-14T06:41:35.816066Z","submitted_at":"2023-07-29T09:22:54Z","title":"A Theory for Emergence of Complex Skills in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15936","snapshot_observed_at":"2026-08-07T04:38:59.692682Z","title":"A theory for emergence of complex skills in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.692682Z"},"links":{"cited_paper":"/paper/2307.15936","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:a2cff5a915e5149921fd148e0d7b9131cc88534f4a6e33922df4649b02199af1","observation_id":"323f5800-c654-42bf-bf47-a1cd174d365e","resolution":{"observed_at":"2026-08-07T04:38:59.692682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:21.475422Z","title":"Act: A simple theory of complex cognition","venue":null,"work_id":"b7ca05df-4341-422d-b075-4c38f126cb8e","year":1996},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.865157Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:bded82a52e56947eb64acf2a040c3b1b82ad8d825978df8b397103d080993bbf","observation_id":"dd022874-2223-4474-b16b-b755d05ea680","resolution":{"observed_at":"2026-08-07T04:39:21.603880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:00.029614Z","title":"Claude 3.5 sonnet","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.029614Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:64e9c9d4747a035250076813c25195c0accc727244c1e9592b2efaec3d7284f5","observation_id":"ca7e7632-217f-4820-802b-4c8cee2d224f","resolution":{"observed_at":"2026-08-07T04:39:00.029614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:21.226977Z","title":"Invariant risk minimization games","venue":null,"work_id":"cb25847e-5346-48da-960a-94d1079f33b3","year":2021},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.175600Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:3b3f80fdd7fb3ebf1fd5a473ec0e1e5b7828347c3def8889e20fba471784b754","observation_id":"97128679-f3c6-4143-a62b-96ebb4500eac","resolution":{"observed_at":"2026-08-07T04:39:21.362767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:20.938322Z","title":"Sample complexity of interventional causal representation learning","venue":null,"work_id":"31f88a11-3048-485c-b30e-7da68f049985","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.301780Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:8e4fd3707be99933f786cfa2276c9af197afbb06027f870ce3789f2340306bc3","observation_id":"2fd55be9-42e3-4bcf-b189-a167d0608724","resolution":{"observed_at":"2026-08-07T04:39:21.076782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16947","last_updated":"2024-08-30T00:06:29Z","snapshot_observed_at":"2026-08-12T22:54:49.604752Z","submitted_at":"2024-08-30T00:06:29Z","title":"An Empirical Study of Scaling Laws for Transfer","version":1},"cited_work":{"arxiv_id":"2408.16947","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.16947","snapshot_observed_at":"2026-08-07T04:39:10.227640Z","title":"An Empirical Study of Scaling Laws for Transfer","venue":"cs.LG","work_id":"be4c2bfe-f52d-48ba-9f8c-0d3953f9b3a2","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.420894Z"},"links":{"cited_paper":"/paper/2408.16947","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:af8e4de6f9ca98d98c4e8d924dc8ebc10fdac131ef28066572aa6ee5c3ccf999","observation_id":"fd4b8802-aceb-47e8-92be-dcf3980c068b","resolution":{"observed_at":"2026-08-07T04:39:10.333127Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:20.677347Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4, 2023","venue":null,"work_id":"302ce115-c36e-4e2d-9084-228a934c22d1","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.595168Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:ef153aacf91c7a2e62aa6fbb6b3f4ec902b9db20fb61cdf6e640f08441db1c4d","observation_id":"40d4409f-9bed-4740-8485-c6a929d68c88","resolution":{"observed_at":"2026-08-07T04:39:20.780177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:20.436611Z","title":"Functional magnetic resonance imaging evidence for a hierarchical organization of the prefrontal cortex","venue":null,"work_id":"dcb65cd1-7957-4efc-8647-fbdba8298862","year":2007},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.740456Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:cb1fbdce3c63e0d525a17d90fd5db6a6feb749626c35b8ccfbcf23489de72a66","observation_id":"c3209fdd-7f3b-4df6-92c4-d79458060d6e","resolution":{"observed_at":"2026-08-07T04:39:20.563436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:20.097925Z","title":null,"venue":null,"work_id":"efc6b3e4-bdca-412f-93c0-3b641b1be97e","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.833696Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:3b674ef9e3518ab80edf4229a4505914e64f2b2192646c9b5c8d460058e89f2b","observation_id":"28e5998b-8552-4b06-98a8-47f9b8422bde","resolution":{"observed_at":"2026-08-07T04:39:20.264283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T04:39:00.939328Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.939328Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:4e7ddace9820a600d88f20db27db5504716cd65390dd921af54dc39ae644ca5a","observation_id":"de90e3fb-28f1-4a21-98d1-5b775466815d","resolution":{"observed_at":"2026-08-07T04:39:00.939328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:01.031708Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.031708Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:8211e759a77e0fece3a8a04850cdbaf4c6008b635cf14136dc48a0e2c4679de2","observation_id":"d1bc4a66-c46d-4d88-9e53-8b750f4aa34b","resolution":{"observed_at":"2026-08-07T04:39:01.031708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:19.826871Z","title":"Doubly robust estimation in missing data and causal inference models","venue":null,"work_id":"aa1d9fac-8f7d-4d52-822f-cae7be88f628","year":2005},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.151962Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:c5dafe42aba8769519c8e74b0c32a311f9b346d53e2878d950e0ad3961b53ba1","observation_id":"7649992c-1cff-4468-8717-a0b1067f98db","resolution":{"observed_at":"2026-08-07T04:39:19.971550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:19.581922Z","title":"Learning linear causal representations from interventions under general nonlinear mixing","venue":null,"work_id":"e0faefc7-e531-404f-9311-7c55794813a6","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.286884Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:2722e3021784992521ac3eace18af19cbe0749361acb9a1c34de413ef4e0ed79","observation_id":"857afd46-23ef-43f6-9372-24649b25d46b","resolution":{"observed_at":"2026-08-07T04:39:19.707898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:19.281501Z","title":"Rethink reporting of evaluation results in ai","venue":null,"work_id":"44bd04cf-b458-4806-87df-3489c958f8cc","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.423173Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:4c7d857a0bc01fca221b3355f0dc00de27dd47353ad3fd98525654fee664e5ad","observation_id":"3bb65a48-2ff1-4618-8223-bc7b379979e2","resolution":{"observed_at":"2026-08-07T04:39:19.444566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:19.089873Z","title":"Human cognitive abilities: A survey of factor-analytic studies","venue":null,"work_id":"24af8544-53cc-4207-94d9-8ed4528cd0a3","year":1993},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.519923Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e74f14a27ccabf1ea3fcb057ffb0d48c98937f6486d3029929c0bec830cc95f9","observation_id":"84b957a0-8a8e-41cb-bb57-2f13895a89bc","resolution":{"observed_at":"2026-08-07T04:39:19.178680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:18.872636Z","title":"Structured matrix completion with applications to genomic data integration","venue":null,"work_id":"0fbb9410-5038-49b6-b1cc-580c7fbbd967","year":2016},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.666052Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:96cb1bca990ce672d64e7e2388255e3972014c1f38a06fb6531793ec605a3ea7","observation_id":"bf2150c2-40a9-474f-b6d2-6d27f54b0205","resolution":{"observed_at":"2026-08-07T04:39:19.014912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:18.684252Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":"e6d3d9ab-5b94-41ea-a246-e2b06c97fe27","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.791402Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:dd6036419957875ded4061144cbdea098b6a58215de53264070f35cc92f4980c","observation_id":"6620d5e0-d391-495b-981b-11bed8aa9c9d","resolution":{"observed_at":"2026-08-07T04:39:18.768882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00304","last_updated":"2024-07-16T20:09:47Z","snapshot_observed_at":"2026-08-13T10:43:30.157057Z","submitted_at":"2023-08-01T05:54:12Z","title":"Skills-in-Context Prompting: Unlocking Compositionality in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00304","snapshot_observed_at":"2026-08-07T04:39:01.927070Z","title":"Skills-in-context prompting: Unlocking compositionality in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.927070Z"},"links":{"cited_paper":"/paper/2308.00304","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e2d3b58959eb3fa93f348e66f7c2e9dce38212f5aa173985c41f802e2bf062db","observation_id":"d8a950a4-6679-4d8a-92ba-1c55ccafa577","resolution":{"observed_at":"2026-08-07T04:39:01.927070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:02.067496Z","title":"The rising costs of training frontier ai models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.067496Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1f2f5683f6df6d0089f2b11b7684229c5b11f423bf1df2dd5ddee72a7d84287c","observation_id":"1dfe70fd-f5c0-4fc1-aaf1-7425c99c5ad9","resolution":{"observed_at":"2026-08-07T04:39:02.067496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20807","last_updated":"2025-03-24T20:41:57Z","snapshot_observed_at":"2026-08-14T22:51:19.462986Z","submitted_at":"2025-03-24T20:41:57Z","title":"Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20807","snapshot_observed_at":"2026-08-07T04:39:02.165360Z","title":"Fundamental safety-capability trade-offs in fine-tuning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.165360Z"},"links":{"cited_paper":"/paper/2503.20807","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:d5bc7fb050af53d74730b1cb678a889f0f53a091b473eda4931fee703a5df426","observation_id":"39da5403-40f6-4d78-85f8-53acdaf25241","resolution":{"observed_at":"2026-08-07T04:39:02.165360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:18.429443Z","title":"Dorner, and Moritz Hardt","venue":null,"work_id":"d8c0bb4f-7a38-44cd-af79-07b932b2b060","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.265998Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:09b9ea2ebc0e589cc96b7bde378f30434d2da2df056a7f12c11c42c3881f2333","observation_id":"7e9df1be-6852-46da-ad51-2f837412750e","resolution":{"observed_at":"2026-08-07T04:39:18.578874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:18.196634Z","title":"Identifiability, separability, and uniqueness of linear ica models","venue":null,"work_id":"0b5ef25b-3e2f-4dc0-bed8-ffe39988d92e","year":2004},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.359901Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:6d2a8cb57c1c2b5ccd19512478c33eb6ef7e3a00067cddcb5f805e30f0f6719d","observation_id":"807a6921-792e-43e7-875f-c09fd906eb46","resolution":{"observed_at":"2026-08-07T04:39:18.327581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.929556Z","title":"Principal stratification in causal inference","venue":null,"work_id":"e88cbbd4-38af-4f87-a861-bf861b2b27f6","year":2002},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.506121Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:2e974332a9a135ed881fe0da93ddd3685164cc2dd8592eee2d09003bd83045f5","observation_id":"2c12e803-a29a-4dde-af3c-70755a429496","resolution":{"observed_at":"2026-08-07T04:39:18.071636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-08-14T13:46:28.086398Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-07T04:39:02.608864Z","title":"Cognitive behaviors that enable self-improving reasoners, or, four habits of highly effective stars","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.608864Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:2b09f7fdf9abfea153fe0ff223f54f9d8fcbe93aaa6ef594cb825979b28b44fb","observation_id":"c20bbc66-5403-4642-90ff-540b56ac89df","resolution":{"observed_at":"2026-08-07T04:39:02.608864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:39:02.765458Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.765458Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:553ca77a5a3ccad7380f08c079c6f94dd23e898d076e079d9aba1299f112a126","observation_id":"849a6744-74d9-45f2-998d-3f792d00d034","resolution":{"observed_at":"2026-08-07T04:39:02.765458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05119","last_updated":"2024-07-14T18:14:57Z","snapshot_observed_at":"2026-08-14T19:37:18.095875Z","submitted_at":"2024-02-03T04:45:25Z","title":"A Closer Look at the Limitations of Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05119","snapshot_observed_at":"2026-08-07T04:39:02.897278Z","title":"A closer look at the limitations of instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.897278Z"},"links":{"cited_paper":"/paper/2402.05119","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:9ab40807b4bda4da832973e3e265ab5690309fee79be9abd1d584689cc8a4816","observation_id":"7d32ca32-d261-4266-856b-6b8ccba45fc0","resolution":{"observed_at":"2026-08-07T04:39:02.897278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08493","last_updated":"2024-02-21T22:02:26Z","snapshot_observed_at":"2026-08-13T10:33:32.397439Z","submitted_at":"2023-08-16T16:48:57Z","title":"Time Travel in LLMs: Tracing Data Contamination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08493","snapshot_observed_at":"2026-08-07T04:39:03.018166Z","title":"Time travel in llms: Tracing data contamination in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.018166Z"},"links":{"cited_paper":"/paper/2308.08493","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:93a0824d54972a8fca42fd29c14e8e4f80a6e08fc958444e8b26d1de998672f0","observation_id":"82985dc9-bd92-446b-8882-303e50b9e7c8","resolution":{"observed_at":"2026-08-07T04:39:03.018166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15717","last_updated":"2023-05-25T05:00:12Z","snapshot_observed_at":"2026-08-12T18:39:37.539896Z","submitted_at":"2023-05-25T05:00:12Z","title":"The False Promise of Imitating Proprietary LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15717","snapshot_observed_at":"2026-08-07T04:39:03.121696Z","title":"The false promise of imitating proprietary llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.121696Z"},"links":{"cited_paper":"/paper/2305.15717","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:44dd7c0ec31b9d377d288407ae86325114161f4311f6150cf2c4d62e89fc616a","observation_id":"33ff0e5e-6777-48b0-b73c-b62777dc885f","resolution":{"observed_at":"2026-08-07T04:39:03.121696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:39:03.260732Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.260732Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:05c8b2450e115382759d6a892757eda62c496b8e48d5fff3a8c1a66367f7c90d","observation_id":"9e9bbc31-52ce-4479-b1f1-b5fc9942309e","resolution":{"observed_at":"2026-08-07T04:39:03.260732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T04:39:03.396804Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.396804Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:ee154a2521132159e8e1b2ce644ecca9b256fd3f9ee3a067e8147a1ded413942","observation_id":"93854879-eefc-408e-8f1c-b23c9976534a","resolution":{"observed_at":"2026-08-07T04:39:03.396804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T04:39:03.523942Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.523942Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:0e78b0ac9dd8a22e5f2d670f8ad015282109db073cf06391887c27c5cf91bc5e","observation_id":"5a909a64-fc2e-4849-a803-da729610dba1","resolution":{"observed_at":"2026-08-07T04:39:03.523942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:03.687198Z","title":"A sober look at progress in language model reasoning: Pitfalls and paths to reproducibility","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.687198Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:ae0e1611ebfb203ff59001199dd9268180e3926eadf13c36a5ed8be171a1a3e1","observation_id":"72fe85d4-2dc7-4e8a-ab90-6ec234298961","resolution":{"observed_at":"2026-08-07T04:39:03.687198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06000","last_updated":"2024-12-08T17:19:48Z","snapshot_observed_at":"2026-08-14T12:26:41.406022Z","submitted_at":"2024-12-08T17:19:48Z","title":"Does RLHF Scale? Exploring the Impacts From Data, Model, and Method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06000","snapshot_observed_at":"2026-08-07T04:39:03.757222Z","title":"Does rlhf scale? exploring the impacts from data, model, and method","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.757222Z"},"links":{"cited_paper":"/paper/2412.06000","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:293bae80779e15d8ee8108876a908881daed28fae6356bc0df836cb79f5d7db1","observation_id":"886fbafc-d79a-45da-80cf-f7b5384439e1","resolution":{"observed_at":"2026-08-07T04:39:03.757222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.659823Z","title":"a rinen, Jarmo Hurri, Patrik O Hoyer, Aapo Hyv \\","venue":null,"work_id":"8c87613b-54b3-4223-9ab6-6952eda8d90a","year":2009},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.893871Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:d98f38c46a2e66e3afc19ecf2ef38e4488388d8d6640b45cdf0e34992cf0e528","observation_id":"cba8e590-0fb3-4069-bd68-0bbe6e8f6aa6","resolution":{"observed_at":"2026-08-07T04:39:17.772086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.446635Z","title":"Causal discovery from heterogeneous/nonstationary data","venue":null,"work_id":"8c0aac6e-3a24-48b3-8ed8-974a310cc095","year":2020},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.984543Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:43a69ea1fb6275e9d67e1bb4679eaa02a8da6f2d72ba25826ffafbc275ea7c11","observation_id":"13fb752e-d767-4945-a0d1-4a2f5b3702ff","resolution":{"observed_at":"2026-08-07T04:39:17.523010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.209935Z","title":"Learning linear causal representations from general environments: Identifiability and intrinsic ambiguity","venue":null,"work_id":"0c7c0a71-6821-48ea-bcf7-62fba0a33fa7","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.095786Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:6892045e0f4f9c72349691ffee839de432188a450dd87e13c2880d8902dc019c","observation_id":"ed05d5e7-26e2-4a10-a86b-55338cf6d2f2","resolution":{"observed_at":"2026-08-07T04:39:17.319643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T04:39:04.248793Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.248793Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:7cb468be623292ee32da966d10b16b729641b1cd817ad0dcc2356427f31f4b77","observation_id":"5e90efc9-8eca-49ef-b053-d41769d333a8","resolution":{"observed_at":"2026-08-07T04:39:04.248793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.005161Z","title":"The construct of creativity: Structural model for self-reported creativity ratings","venue":null,"work_id":"565d16d7-d127-4d92-9e38-e39cc95c5a9d","year":2009},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.353312Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:637e04d49a708b58e9bc77dbbda9cd688e10f43c673f6408e0b04373abfcb924","observation_id":"64ff5b48-23e3-49b0-aaef-91c840753910","resolution":{"observed_at":"2026-08-07T04:39:17.096415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T04:39:04.466095Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.466095Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:51e1eab8601cebbdfa1390082093fafb74f1ca48e59fa5946ca8e04c9e1996e9","observation_id":"9bc53b76-d732-483d-a549-ee7364b8092b","resolution":{"observed_at":"2026-08-07T04:39:04.466095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:16.732683Z","title":"The architecture of cognitive control in the human prefrontal cortex","venue":null,"work_id":"28da908c-0f4e-4f5f-bbb5-27881a306193","year":2003},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.555256Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:9b236c0e89eb72597709a7f758545aea4ab6b86be77f538288d782019bd5e55b","observation_id":"1c4027f5-05b3-45e0-bd1b-e61aa5e720a8","resolution":{"observed_at":"2026-08-07T04:39:16.815111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:16.515765Z","title":"Solving quantitative reasoning problems with language models","venue":null,"work_id":"206369b2-5c3d-4a9f-bcb6-ee5c0100526c","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.647940Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:36886d06e3e27a1ea72d56ff7dfdde9d40326ed43c6451cb737e2978caae8d0f","observation_id":"4312c244-0569-4849-9e3e-5e2b03dc4fc9","resolution":{"observed_at":"2026-08-07T04:39:16.615163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:16.282205Z","title":"Holistic evaluation of language models","venue":null,"work_id":"8e27b5a1-ded2-414a-99dc-5ca4bc4977a0","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.799167Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1e167b80790900c52c2dd58c16dfa1d79e0e63a32d52910df9ce9a4f5d182abc","observation_id":"7c8ef998-8f49-4b69-8240-766ef8ac77ad","resolution":{"observed_at":"2026-08-07T04:39:16.405930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.03862","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:09.795832Z","title":"Not-just-scaling laws: Towards a better understanding of the downstream impact of language model design decisions","venue":null,"work_id":"ebd1ffa1-b672-465f-98c9-83e64e69c00a","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.907319Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e303c3b2d268a1255d4c83c70930c25cb4b4f893f9f9aec38dc77a8717fd0cef","observation_id":"881357b0-9473-403a-a862-0ed62aa483e5","resolution":{"observed_at":"2026-08-07T04:39:09.929296Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:16.049108Z","title":"a tsch, Bernhard Sch \\","venue":null,"work_id":"2268fbfb-8008-46ac-9370-d923d495d776","year":2020},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.057279Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:6a340416e6e1324d5043f11db8dbff99a877161e696738f3a6b33912c627502f","observation_id":"92014512-796e-41ce-8bbe-2f557bb3087a","resolution":{"observed_at":"2026-08-07T04:39:16.156807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:15.841139Z","title":null,"venue":null,"work_id":"b789266b-4ab9-41cb-b900-5338cf11c18d","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.192921Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:6e71953aa2dbe08e5698a361f5118ef4e52e2009a89169520ac4d7a09c90f6b3","observation_id":"ea42288d-69a3-4cf0-9cd3-d8799c45b5c5","resolution":{"observed_at":"2026-08-07T04:39:15.966129Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:15.559735Z","title":null,"venue":null,"work_id":"0c2ac53d-250a-4c29-9f26-61321e906398","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.265187Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:ef7361640092b3576440e99afd1a39dbcbe7bab1249305925f82aba63104b4cb","observation_id":"97c7bca5-0022-4283-920a-2f2dfbe117bf","resolution":{"observed_at":"2026-08-07T04:39:15.646961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:05.358578Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.358578Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:31caae7a1a84f8bd82711397a3f81aab4e6f1ad1a24333e34fcef9f916c15efe","observation_id":"01771925-1151-4807-8901-d210432db236","resolution":{"observed_at":"2026-08-07T04:39:05.358578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:15.347802Z","title":"Causal diagrams for empirical research","venue":null,"work_id":"c849c7eb-92f0-47ef-9dcb-eca8017606ee","year":1995},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.492378Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:27d8edb550f235f8bf03fc9f1b46edf746eab0f64fcfc74e437a96a4cb6c433d","observation_id":"f372a1cc-a702-4d7d-930a-873e20d78ab7","resolution":{"observed_at":"2026-08-07T04:39:15.450728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:15.041158Z","title":"On the identifiability of bayesian factor analytic models","venue":null,"work_id":"390c95c8-0b20-4c3d-a5d0-49b98cb2538b","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.639697Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:00a0d610edb87840bd58c83903b20465592468b1b4da7afb68304dae18749073","observation_id":"a2777412-bf94-44ab-a025-aa78374b6908","resolution":{"observed_at":"2026-08-07T04:39:15.225195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.06540","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:09.558687Z","title":"Sloth: scaling laws for llm skills to predict multi-benchmark performance across families","venue":null,"work_id":"5f6d48fc-fd85-44bc-bd0c-11ddd76f0129","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.766473Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:9c9ee984df6efa0d6a6c4a11b8249342fa1c6d8d74bcb7908c3131b4409c12f6","observation_id":"083c9f47-7b1d-403f-86ab-81f1d9818fe8","resolution":{"observed_at":"2026-08-07T04:39:09.635730Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:14.800891Z","title":"Evolm: In search of lost language model training dynamics, 2025","venue":null,"work_id":"e3d660ed-eaf6-407f-9e7b-cae2e7a2de28","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.895689Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:98df5d723ea83f3d5f3b7f4968c27e880192cbf6a797b48f473438da9f5ccb5e","observation_id":"1db11138-c297-4adc-a336-ddc03eb2eccf","resolution":{"observed_at":"2026-08-07T04:39:14.927579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:14.539304Z","title":"Safetywashing: Do ai safety benchmarks actually measure safety progress? Advances in Neural Information Processing Systems , 37:68559--68594, 2025","venue":null,"work_id":"bd1a1fb5-004d-4e2e-9ab0-2351d9f7e255","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.006821Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:bbb360a0b6d7c6fac3593ff0e9cc655a18ac2c30463c903786bc424ea0af517e","observation_id":"ff26cae3-b612-4087-9aec-7b5096df579f","resolution":{"observed_at":"2026-08-07T04:39:14.638098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:14.297039Z","title":"A simpler approach to matrix completion","venue":null,"work_id":"22eef505-82cb-45d3-b1bb-51e9f6711ba8","year":2011},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.141851Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:34381e8b74c0430142c8b6557401caaf812473d4cd15c53983225cb0be31f4f9","observation_id":"a1ca435d-8a21-45ea-ab4b-468a3923f8da","resolution":{"observed_at":"2026-08-07T04:39:14.398228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:13.981201Z","title":"Maddison, and Tatsunori Hashimoto","venue":null,"work_id":"eb7980d6-5fc9-4b26-921a-24f5d0d6f715","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.258579Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:0f66ada16250e3ad38ec20b0261c4a10fdbe5dabfad7ef20817ae02c4fc31490","observation_id":"020ec77d-927a-44b5-bd45-76219c69c749","resolution":{"observed_at":"2026-08-07T04:39:14.153380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:13.701155Z","title":"The architecture of complexity","venue":null,"work_id":"527b4318-11b9-4533-abb3-792076e4bd9b","year":2012},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.427379Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:b6d8d3511353e5d4b44defd21fb972e5e23a6713c925f2365448d76e2e5a566c","observation_id":"2ce67ae2-8170-467a-9f1a-493f5c3cf32a","resolution":{"observed_at":"2026-08-07T04:39:13.814004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:13.451145Z","title":"Toward causal representation learning","venue":null,"work_id":"f94d64fb-652c-4f68-b287-28333373e2f1","year":2021},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.577987Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e937f172f8c0a745eaf6f169bab85efc8fa4abd3d018e9f65e218a96fc7fb290","observation_id":"cbcacfde-0564-4ca1-b2d9-e9efccb98d3f","resolution":{"observed_at":"2026-08-07T04:39:13.607870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:13.153820Z","title":"Are emergent abilities of large language models a mirage? Advances in Neural Information Processing Systems , 36:55565--55581, 2023","venue":null,"work_id":"b217ae1d-4228-45e1-a376-1cbe4a4b3541","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.764599Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:23afca95b4de71c6a8f14cea2efb8257bfb816cbba4ff050cd2f86610b2dc6ec","observation_id":"d5ef6c67-2fbf-4fc2-b28c-4f51f55ad966","resolution":{"observed_at":"2026-08-07T04:39:13.298759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:12.961628Z","title":"Linear causal disentanglement via interventions","venue":null,"work_id":"170aade3-3d2d-4b4d-a424-c44b4330fbce","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.874199Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:b5d0bcd4a80a7080629f7db4b4e20ad3b6cb4b2cd2ad2f83688bfe65af26045f","observation_id":"f1ba9a89-d3de-498a-bbe6-5fc7d8e95d76","resolution":{"observed_at":"2026-08-07T04:39:13.047722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-07T04:39:07.048487Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.048487Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:8301b097804e440fa6b4d20a1d623366596c88b83fc55722894ece5199d0edc7","observation_id":"438ce11a-8062-4d6d-be7d-3c818cee1042","resolution":{"observed_at":"2026-08-07T04:39:07.048487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:12.706227Z","title":"Matching methods for causal inference: A review and a look forward","venue":null,"work_id":"c3367ab3-9929-444b-9978-1f81e422886b","year":2010},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.185664Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:b1469656f32183e223f7457d5d6fb237296c5bbb755b891ced86af944892f10f","observation_id":"4892c736-dcf1-442d-9bff-2c472a3fbf90","resolution":{"observed_at":"2026-08-07T04:39:12.811869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:12.473473Z","title":"Multitask prompted training enables zero-shot task generalization","venue":null,"work_id":"7cc893d2-2ff8-4036-8a2f-4f121893c75e","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.300084Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:5cc37b6c0a4daea5842447f042fccbdbf10845bdcd1cd3991cdc752c48d7a779","observation_id":"a36f9775-fad5-4d4c-8e26-65fa47f22c1d","resolution":{"observed_at":"2026-08-07T04:39:12.582736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:12.100386Z","title":"How to grow a mind: Statistics, structure, and abstraction","venue":null,"work_id":"798db6cb-111b-4e37-88c1-ae554c680a25","year":2011},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.438379Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:5fa58d3ea019c6f7257694e90c81cd04560a9292a404e80295f56ccc4d48c86b","observation_id":"15e875bb-d667-44a3-bec2-c9254e3f50d1","resolution":{"observed_at":"2026-08-07T04:39:12.236470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T04:39:07.609846Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.609846Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:d6420f5c85cdebf73ba0102fb22a2c158938391b8831da53228fc0c8b86eb9c8","observation_id":"66a6f830-b240-4aa7-9e91-150b1b1525c0","resolution":{"observed_at":"2026-08-07T04:39:07.609846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13335","last_updated":"2025-03-17T16:15:02Z","snapshot_observed_at":"2026-08-07T16:57:21.932530Z","submitted_at":"2025-03-17T16:15:02Z","title":"Reliable and Efficient Amortized Model-based Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13335","snapshot_observed_at":"2026-08-07T04:39:07.776135Z","title":"Reliable and efficient amortized model-based evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.776135Z"},"links":{"cited_paper":"/paper/2503.13335","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:4f126abe64015322530c8363a0b5a1a1e3151f22254e296ac84285112e921dbf","observation_id":"452ada49-09c1-4ce3-b06b-6cce064e17b0","resolution":{"observed_at":"2026-08-07T04:39:07.776135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:11.868867Z","title":"u gelgen, Michel Besserve, Liang Wendong, Luigi Gresele, Armin Keki \\'c , Elias Bareinboim, David Blei, and Bernhard Sch \\","venue":null,"work_id":"9bc5a71c-0b35-4281-88ce-a5ce9e3b24cf","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.990648Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:d99fd817bf097238b2dcfcb457f17cf0eec9aef5aebdd8acefb73750237dbca6","observation_id":"41453dd2-3a78-490f-9438-c4781d8369bc","resolution":{"observed_at":"2026-08-07T04:39:11.977760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:11.580935Z","title":null,"venue":null,"work_id":"e99323e2-cc33-4e1c-bd48-64e2bb72eba2","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.126619Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:a9f75aeb70e2ac0154d00bc923aab8cf4da62a9552ab772ab2622fe15366a450","observation_id":"ba62fe5e-c8d8-42d4-a336-c7fd2d071bec","resolution":{"observed_at":"2026-08-07T04:39:11.736778Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T04:39:08.295838Z","title":"Emergent abilities of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.295838Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:0b403447c54bae92d0aaa8dca74eae5abaa51f4d08d710c8c4820a5067395b35","observation_id":"5f73c6e8-86c4-4284-861f-1fc363db16fd","resolution":{"observed_at":"2026-08-07T04:39:08.295838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17567","last_updated":"2023-10-26T16:55:05Z","snapshot_observed_at":"2026-08-14T09:29:06.512962Z","submitted_at":"2023-10-26T16:55:05Z","title":"Skill-Mix: a Flexible and Expandable Family of Evaluations for AI models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17567","snapshot_observed_at":"2026-08-07T04:39:08.432069Z","title":"Skill-mix: A flexible and expandable family of evaluations for ai models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.432069Z"},"links":{"cited_paper":"/paper/2310.17567","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:31efc0957b79b8e6321f7f658cd0250bc3a68e11a6a107a64ab17211f2b71632","observation_id":"2ca6bb1b-f90a-44ac-a0a6-4acc444e8649","resolution":{"observed_at":"2026-08-07T04:39:08.432069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:39:08.522540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.522540Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:715ca110e25ff549a1e56ec0f6125dde3548bd3ad7d82971cb80987c9ab14594","observation_id":"4f700dc1-78d5-40f7-88eb-c72c490540eb","resolution":{"observed_at":"2026-08-07T04:39:08.522540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:11.305964Z","title":"Unveiling the impact of coding data instruction fine-tuning on large language models reasoning","venue":null,"work_id":"f71b2ec8-9926-40e0-a32c-7ed44485bbb2","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.626556Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:663a8400176b420c7c2f313b9cb0bb8004555aa54cdf869293e129ded432db88","observation_id":"3b99727a-a679-4969-a46c-9ba35f4e0e31","resolution":{"observed_at":"2026-08-07T04:39:11.451018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:11.038441Z","title":"Identifiability guarantees for causal disentanglement from soft interventions","venue":null,"work_id":"59187866-0f0c-4169-b584-840932cdf94c","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.739725Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:6b266bb0feb98f2f1c130b22510e08f7787df692d692089fb50e800073a37eea","observation_id":"a238c3eb-9b06-4095-973b-b8ec36056841","resolution":{"observed_at":"2026-08-07T04:39:11.181960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:10.747788Z","title":"When scaling meets llm finetuning: The effect of data, model and finetuning method","venue":null,"work_id":"3f9f3555-4d58-4645-91e7-bd34002b113d","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.867178Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:dc3777cd311f26cb9be6eda3ffe10cf3981514b683492e0afc81b19b25f84b87","observation_id":"d8d350f2-3699-4bd4-bfc3-42f09638ad17","resolution":{"observed_at":"2026-08-07T04:39:10.917752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07912","last_updated":"2025-08-07T23:50:47Z","snapshot_observed_at":"2026-08-10T19:31:41.185985Z","submitted_at":"2025-04-10T17:15:53Z","title":"Echo Chamber: RL Post-training Amplifies Behaviors Learned in Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07912","snapshot_observed_at":"2026-08-07T04:39:08.980643Z","title":"Echo chamber: Rl post-training amplifies behaviors learned in pretraining","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.980643Z"},"links":{"cited_paper":"/paper/2504.07912","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1517f6b388b2051db82976aac935d1338bc7d82e5f5f54682bb2c673901d25fd","observation_id":"77f34f5e-32a2-486f-a497-2323514f9ea2","resolution":{"observed_at":"2026-08-07T04:39:08.980643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10313","last_updated":"2023-12-05T08:59:33Z","snapshot_observed_at":"2026-08-13T14:29:50.623753Z","submitted_at":"2023-09-19T04:51:13Z","title":"Investigating the Catastrophic Forgetting in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10313","snapshot_observed_at":"2026-08-07T04:39:09.135335Z","title":"Investigating the catastrophic forgetting in multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:09.135335Z"},"links":{"cited_paper":"/paper/2309.10313","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:b266545396587f93ee3f766734dad865ea74453dd4a0f13e5793e017432419c2","observation_id":"1eb0872c-5acd-485a-87f7-9bb5fa1505fd","resolution":{"observed_at":"2026-08-07T04:39:09.135335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:10.514242Z","title":"Causal representation learning from multiple distributions: A general setting","venue":null,"work_id":"1744236f-39e9-494b-9cb0-e097ab1f59b0","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:09.218815Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:30c0d1a2f7c92a7f95a3c018c83353acb4805ce01eac3acf8199218fcffb3e00","observation_id":"d0606cbd-59fc-4474-a7f6-d801b108c258","resolution":{"observed_at":"2026-08-07T04:39:10.609813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T00:19:21.130818Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":3,"verified_fuzzy":41},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 3 inbound Pith citation observations for arXiv:2506.10378."}