{"as_of":"2026-08-23T05:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a787c3803ba04d76a66fb56861fe40ad3bc9e38435bb51e365794d1e9d93ad0f","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T12:21:42.088795Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.21906/citation-record","integrity":"/paper/2606.21906/integrity","json":"/paper/2606.21906/citation-record.json","paper":"/paper/2606.21906"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":"2112.00861","doi":"10.48550/arxiv.2112.00861","metadata_source":"pith","pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A General Language Assistant as a Laboratory for Alignment","venue":"cs.CL","work_id":"a43f9ea0-01be-47d5-b8ee-a1a9f73381c5","year":2021},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:59d0e914f20547f51f9051a8528b67d986d6cba474cc11bf204ece4586297713","observation_id":"fc86705e-cba9-471b-a09d-89369334a3e5","resolution":{"observed_at":"2026-07-04T07:59:40.105129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:13.802987+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:13.802987+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-08-14T11:50:41.917778Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":"2303.08112","doi":"10.48550/arxiv.2303.08112","metadata_source":"pith","pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","venue":"cs.LG","work_id":"a127314f-7424-488f-b6d7-8214650c420f","year":2023},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:c6d5df705fa5e1ea7837d59f64296c00fc5d3e95d41354eee06d403bea22bfc3","observation_id":"56a2b02b-9856-476c-891e-c102a7078b3a","resolution":{"observed_at":"2026-07-04T07:59:40.102550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:41.570848+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:41.570848+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:10a8c224477f1e0bd1cc27a19a91abf2e53633e8dab49ed0f28c7dcdb46e3359","observation_id":"826b59a2-a2ce-4fa0-acb6-7e42761a6d72","resolution":{"observed_at":"2026-07-04T07:59:40.099944Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Transformer feed-forward layers build predictions by promoting concepts in the vocabulary space","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:de86fe4c5f9a47dd0b1fffc6dca7e54145f5e3868f51755f973c225513eb5159","observation_id":"859a0e6c-20e9-48ca-b059-040568c823db","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Dissecting recall of factual associations in auto-regressive language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:b9ef19eddbb6eaae88a900afc23220c6012456a1dbff29a63dbe04eaf59a388b","observation_id":"d00e2c91-06fb-4487-bfe6-95648d3f4e3a","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18871","doi":"10.48550/arxiv.2510.18871","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do llms use their depth?arXiv preprint arXiv:2510.18871","venue":"arXiv (Cornell University)","work_id":"776ea885-519f-4790-8e33-cac642cc672d","year":2026},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:5afda17af69b7502ca8b7a6d964508e631b5f00842f780efc9cead5d9a210e44","observation_id":"952e87b1-bba6-49f9-9622-bdbbc1374099","resolution":{"observed_at":"2026-07-04T07:59:40.122455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Inference-time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:835f00c7dba020bdabc2ffbe8091fcb40168bc15a20a258332ef71b930d17161","observation_id":"c3c03b33-93ae-4c1e-9b8e-a3dc965aa4c5","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.03542","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T07:59:40.108882Z","title":"Layer-order inversion: Rethinking latent multi-hop reasoning in large language models.arXiv preprint arXiv:2601.03542,","venue":null,"work_id":"983e9b6f-0633-4c08-aa92-57cf0ffb82b0","year":2026},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:c53c12c20f2220e23c40f5b58b7df16e651152d446c6bf6a7ba7ce9b50316c5f","observation_id":"c3e836b1-9439-427f-9b68-4902d744ace3","resolution":{"observed_at":"2026-07-04T07:59:40.110778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Diffskip: Differential layer skipping in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:21e1a0939295ddb9a5fe30bf42a85637589b032229792d45160404ea7052d5f1","observation_id":"a5ce01a8-a7d6-474a-b21e-1c559e159c14","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Accessed: 2026-02-16","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:8f593b3c696f45ceb58939511b7631142f3f0d5e0a4dafd3d09cf2c850c3ccd4","observation_id":"cfc81bef-5d02-4bb7-92fe-c6c2037968f8","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Trusting your evidence: Hallucinate less with context-aware decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:b2267d967dd175e481c39181513e153b1d8194e5096b2c53d4fa03893345729d","observation_id":"ab7cb403-a851-4411-a81c-8d902bbfba7b","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.23701","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T07:59:40.115162Z","title":"The diminishing returns of early-exit decoding in modern llms.arXiv preprint arXiv:2603.23701,","venue":null,"work_id":"5b9b9669-fa4e-42ed-8ca0-4ff5dce01e17","year":null},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:d8da4203dcf774dee7e24b86ea7dde18c4916f0630a7f2f8866a66668fe0c123","observation_id":"abbebdb4-c20b-4a27-a55e-1885be4bd1e2","resolution":{"observed_at":"2026-07-04T07:59:40.116684Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.15895","doi":"10.48550/arxiv.2504.15895","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dynamic early exit in reasoning models.arXiv preprint arXiv:2504.15895, 2025a","venue":"ArXiv.org","work_id":"99c0642f-2c3c-4bfd-aa41-08cd3fb032e8","year":2025},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:8825745aac9a802767b2f4131d03cb8607ca14fb2bf957629a7edb60d18daf9a","observation_id":"4a0a2670-43a2-498c-8f14-7aa5062c04d8","resolution":{"observed_at":"2026-07-04T07:59:40.113991Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Air-bench 2024: A safety benchmark based on regulation and policies specified risk categories","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:ce4c6cff55b5dfbc9890c0bf8f5640f178c2ba5c326943186f3441a7ff9613b7","observation_id":"adb5a8cd-525f-4eb4-ba82-8648338c1a5f","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Active layer-contrastive decoding reduces halluci- nation in large language model generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:7732e4c015f7c1a2583dc5b4aa9847e4d332a38864a249482bfc69d658356669","observation_id":"ea2ff94a-9bc1-461c-b619-a4c600dbde48","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Generalization or memorization: Dynamic decoding for mode steering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:25621f63250ed6b789cecc6e862ff08fd243ec771953ac80ed7586734f7a5564","observation_id":"79944bff-c872-4e80-9dd5-38ac563f8eec","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Cognition-of-thought elicits social-aligned reasoning in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:379c45dd91d63317ef160a54d2a8dfce6750edd06ab6de07ef59187797755b97","observation_id":"226e3c31-4157-4fa4-b06e-8b18b4e1ae82","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.04404","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T07:59:40.118007Z","title":"Please describe the image","venue":null,"work_id":"5780380b-21c8-473f-aee6-2c63c196f66f","year":2025},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:083305bbe1ec03affd2565b2cbb6bf5883b26c79da3221ef6e33ff39d5f8de76","observation_id":"98e93fc6-c7c6-42b3-97e9-521667ff5931","resolution":{"observed_at":"2026-07-04T07:59:40.119866Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"Continual pre-training of language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:f768fcfde68af64e8a53fa26f5811f751d62285a3a2bcc31b36f07a1270ea844","observation_id":"9d1fd99d-8986-45af-ba9e-8d4a8fe9c7d3","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:9c73843ae8dbe9a0968bc4e1c636a672ede780d2cc480abc91529df5b036d6c4","observation_id":"b026f487-944f-4156-a230-b616cc5b548b","resolution":{"observed_at":"2026-07-04T07:59:40.107743Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:6da8d7450c143d802046efaa4e67ac9d84f428404030c0ef7c72a689e464fb85","observation_id":"f9842565-f8c5-4a8d-bbec-e797a694ef28","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"You should think step-by-step and put your final answer within \\boxed{}","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:8bd43a3e8d60306cc012b0ac8e3d8d0dd529b344a156d70a47b201615406c6c7","observation_id":"f0ec6ebf-09d1-417b-9619-88a3e4d27942","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":"You are an expert evaluator with extensive experience in evaluating response of given query","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:5029909f91cb25fd9aeea9d6c99795dc880b7000a8407747a85827be97047550","observation_id":"2999d430-0b19-48e5-bd0d-2b75c1082b5e","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T12:21:42.088795Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T12:21:42.088795Z"},"links":{"citing_paper":"/paper/2606.21906"},"observation_digest":"sha256:b2c9d3c27ad6ab635f22c227c9c4b7966a1b328939b18f7548f7a2eedf51bc6c","observation_id":"930d7d20-bda1-495e-a295-ba8190150f63","resolution":{"observed_at":"2026-06-26T12:21:42.088795Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.21906","last_updated":"2026-06-20T07:03:26Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T12:58:24.945963Z","submitted_at":"2026-06-20T07:03:26Z","title":"Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":14,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2606.21906."}