{"as_of":"2026-08-09T19:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d02a8318562b36c5f6e10ca06d01aabade4de55f66c8e366a3aeb9406d4d84f","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T22:03:48.854674Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.15893/citation-record","integrity":"/paper/2607.15893/integrity","json":"/paper/2607.15893/citation-record.json","paper":"/paper/2607.15893"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-01T22:03:45.230991Z","title":"arXiv preprint arXiv:2209.11895 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:45.230991Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:ec1d62f62fc5f644933103de19d3fed2509c4b48419ca7664f763f9f56477b58","observation_id":"7e6194e3-bc1c-4a2b-89db-bb9f13d775fe","resolution":{"observed_at":"2026-08-01T22:03:45.230991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:45.375773Z","title":"Transformer Circuits Thread , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:45.375773Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:7dc81097f51dced10f0bb0b88f5a70629fbc05256c079da41f4e2e10d32bb03b","observation_id":"82083af4-ec2c-4c9c-83f4-9fa778a3ce5e","resolution":{"observed_at":"2026-08-01T22:03:45.375773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-01T22:03:45.497072Z","title":"arXiv preprint arXiv:2211.00593 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:45.497072Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:c666924a22f31d534a19a98f96708e91f5979bf1d08f8864d264004c28aa4954","observation_id":"faaaefc1-0879-44d9-81f8-a772e4c4e242","resolution":{"observed_at":"2026-08-01T22:03:45.497072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05969","last_updated":"2023-05-16T16:24:55Z","snapshot_observed_at":"2026-08-06T15:07:58.170997Z","submitted_at":"2023-04-12T16:46:43Z","title":"Localizing Model Behavior with Path Patching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05969","snapshot_observed_at":"2026-08-01T22:03:45.616169Z","title":"arXiv preprint arXiv:2304.05969 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:45.616169Z"},"links":{"cited_paper":"/paper/2304.05969","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:d054df4e76ca00538bdeafc1d917d416225530f7a0c244f7f644e900e2118f4e","observation_id":"4fd4a78c-9fcb-43ce-8c28-cded4f3bac53","resolution":{"observed_at":"2026-08-01T22:03:45.616169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:45.730720Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:45.730720Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:4d6db4f92393ba27f526a89c9b6a9a1acd473f4c4a60fd3574135e88e7ae48cf","observation_id":"a1810705-5520-46b7-aa2e-b83c03fafc85","resolution":{"observed_at":"2026-08-01T22:03:45.730720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:45.816056Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:45.816056Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:5270d6bafefed8cb307afb9b6bc7bf47d4c16320491116815f915d36ed2b363a","observation_id":"d03ca907-970b-41ea-987d-d76283c9e88b","resolution":{"observed_at":"2026-08-01T22:03:45.816056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16834","last_updated":"2024-06-06T21:06:44Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:59:12Z","title":"Discrete Diffusion Modeling by Estimating the Ratios of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16834","snapshot_observed_at":"2026-08-01T22:03:45.951570Z","title":"arXiv preprint arXiv:2310.16834 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:45.951570Z"},"links":{"cited_paper":"/paper/2310.16834","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:6f0a2944cb1ea2107c53875f4945fe6dc247e89aafdbd1ca7423f2abd8fed76c","observation_id":"c1d814fb-5c45-4616-8a44-e8a44d8ba1b0","resolution":{"observed_at":"2026-08-01T22:03:45.951570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.096764Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.096764Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:0ed9900c51dc7c6e9c583e31317956676e57a5c11eb0ac94bd906824bce49ce2","observation_id":"00f27d28-38d6-425c-b0ea-3a241046b23f","resolution":{"observed_at":"2026-08-01T22:03:46.096764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.228106Z","title":"arXiv e-prints , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.228106Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:9388d5cf73387d3a0931988a2c39f27467e3f62c932929fbae81a372ee2c5331","observation_id":"bce4e71d-ab21-4e27-935e-0035675d7a37","resolution":{"observed_at":"2026-08-01T22:03:46.228106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.322733Z","title":"arXiv preprint arXiv:2602.05859 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.322733Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:acfe4cb947cdc7455c0cd7bedf502abcf1673e6041ccb5361521e4d7dcd4199a","observation_id":"00e793b8-bc00-44ed-8861-0469cf5ff3cd","resolution":{"observed_at":"2026-08-01T22:03:46.322733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.417293Z","title":"arXiv preprint arXiv:2601.07894 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.417293Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:b0e55894eb8b52b656cec1531bebc768ac85efe22b6b435aef1b2539d1ed0ab1","observation_id":"55817495-779b-4087-815f-f87b862b6824","resolution":{"observed_at":"2026-08-01T22:03:46.417293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.14758","last_updated":"2026-05-28T16:09:13Z","snapshot_observed_at":"2026-08-03T09:12:52.505155Z","submitted_at":"2026-01-21T08:26:51Z","title":"Mechanism Shift During Post-training from Autoregressive to Masked Diffusion Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.14758","snapshot_observed_at":"2026-08-01T22:03:46.530009Z","title":"arXiv preprint arXiv:2601.14758 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.530009Z"},"links":{"cited_paper":"/paper/2601.14758","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:a644de5fcf0c625d4c92c372583452d897849685031acb972204ecc73372fb92","observation_id":"cdd6a023-0c77-498c-bc98-ac5b66d436cf","resolution":{"observed_at":"2026-08-01T22:03:46.530009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.608799Z","title":"arXiv preprint arXiv:2511.19152 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.608799Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:b22d768a33f03812a6b7397128887e9df01105e9abd79efd1b9a556e7edbb4e6","observation_id":"fed2035d-b905-4403-970f-65a82bfc7f3a","resolution":{"observed_at":"2026-08-01T22:03:46.608799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.677684Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.677684Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:690e95b0e664168373ff782c5e541117ab2913b6ed3d5d2f93291ad7e7451951","observation_id":"648654a7-fde0-4879-a96c-747643843aa7","resolution":{"observed_at":"2026-08-01T22:03:46.677684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.753576Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.753576Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:235406c448ba3fd553e6e82c16c7a9b4de1b1e5d3887117b057216a83c005a49","observation_id":"c4c89c19-bfa6-49e6-ace6-b15aae24ce04","resolution":{"observed_at":"2026-08-01T22:03:46.753576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.839581Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.839581Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:f1ab95fb16a78796f00eba5f77acc274182559ef5c3a2bea3a5161471c1bc679","observation_id":"ce7afc13-204d-4fdd-9745-7759850b8388","resolution":{"observed_at":"2026-08-01T22:03:46.839581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.922148Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.922148Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:ca27859652debfcb648fdc3c786a68f001b5a49c316183b0fed801fe62654f79","observation_id":"88f94a97-3fd6-4701-862c-0d3557784d85","resolution":{"observed_at":"2026-08-01T22:03:46.922148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:46.992623Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:46.992623Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:3e50145c878cf86509d4d91c156b622a110f7ecb113a722e3b23d2e5a0cc1f3c","observation_id":"6c58e250-affa-4924-9f24-39041dd3e9e2","resolution":{"observed_at":"2026-08-01T22:03:46.992623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:47.067315Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.067315Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:498bc2fc7ff9fcca4469854b0394bedfeddcc7c566514f7ade83dbdbf2b1c5cb","observation_id":"8d4a87b1-12ec-4bd5-bb65-7c312ae3536e","resolution":{"observed_at":"2026-08-01T22:03:47.067315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15487","last_updated":"2025-08-21T12:09:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T12:09:58Z","title":"Dream 7B: Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15487","snapshot_observed_at":"2026-08-01T22:03:47.132568Z","title":"arXiv preprint arXiv:2508.15487 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.132568Z"},"links":{"cited_paper":"/paper/2508.15487","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:0b74e94ce56de8c832d71b21338015ec7d5b4bc69e088d80368ea91fc6b2670f","observation_id":"57e1ec8f-9a38-44c1-9854-3ebc1dbe8ca6","resolution":{"observed_at":"2026-08-01T22:03:47.132568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:47.223121Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.223121Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:923a14ef1852b84c184a5522e78078f3287383a8fa990a947fcbe41f6b60b37a","observation_id":"875cec0e-ec90-458c-93c1-d5f36b375faf","resolution":{"observed_at":"2026-08-01T22:03:47.223121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06768","last_updated":"2025-08-19T23:35:57Z","snapshot_observed_at":"2026-08-09T09:47:58.662011Z","submitted_at":"2025-02-10T18:47:21Z","title":"Train for the Worst, Plan for the Best: Understanding Token Ordering in Masked Diffusions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06768","snapshot_observed_at":"2026-08-01T22:03:47.298320Z","title":"arXiv preprint arXiv:2502.06768 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.298320Z"},"links":{"cited_paper":"/paper/2502.06768","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:a262a0b36dc2f209717a4dc014ab10437d5775ecbccbc34b3a6a4b235dadaac3","observation_id":"0763a10f-93ad-47f4-8df0-be35922051a6","resolution":{"observed_at":"2026-08-01T22:03:47.298320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-01T22:03:47.373718Z","title":"arXiv preprint arXiv:2209.10652 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.373718Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:552fc4934b2bc9b5a2b7ed4e272eef6c7562eede614d1296e71468381743f5e0","observation_id":"ea7fe563-77f0-4c56-8740-a983d2100885","resolution":{"observed_at":"2026-08-01T22:03:47.373718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29358","last_updated":"2026-05-28T04:57:47Z","snapshot_observed_at":"2026-07-06T23:38:46.361360Z","submitted_at":"2026-05-28T04:57:47Z","title":"Scaling Monosemanticity: Extracting Interpretable Features from Claude 3 Sonnet","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29358","snapshot_observed_at":"2026-08-01T22:03:47.448377Z","title":"arXiv preprint arXiv:2605.29358 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.448377Z"},"links":{"cited_paper":"/paper/2605.29358","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:359a75acd83fba5dea316b58827ccf19c74aae62b3c7b9684e0ef22c762d72dc","observation_id":"29bd2e04-a428-43d4-8bfc-13126af01676","resolution":{"observed_at":"2026-08-01T22:03:47.448377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:47.529391Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.529391Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:e4a46bea3ed7836bffd611940c67b4c6615d5ae8d27c11f5de981ea96da7aa39","observation_id":"3189e007-46f0-4326-b92d-6aa2dec12a62","resolution":{"observed_at":"2026-08-01T22:03:47.529391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:47.603365Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.603365Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:4b9c219de86bea1f6b4078f454ff3445bfb0de10b043250449d3c354932958d1","observation_id":"dec09e70-f25b-4041-83cf-4b1d48283d8d","resolution":{"observed_at":"2026-08-01T22:03:47.603365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05217","last_updated":"2023-10-19T21:25:32Z","snapshot_observed_at":"2026-08-02T10:20:00.635719Z","submitted_at":"2023-01-12T18:56:49Z","title":"Progress measures for grokking via mechanistic interpretability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05217","snapshot_observed_at":"2026-08-01T22:03:47.716167Z","title":"arXiv preprint arXiv:2301.05217 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.716167Z"},"links":{"cited_paper":"/paper/2301.05217","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:53ce03d17d6ecfbb270fd6c54bdb589518918b7e106a1918daadb267bc2b72f0","observation_id":"fde85198-d810-4e0c-b66b-111fe5a695a4","resolution":{"observed_at":"2026-08-01T22:03:47.716167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:47.788810Z","title":"2026 , month = jun, howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.788810Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:13ae18b760338f5a2941535e9a2508fd0e9d77dcf0cd61bad1ba4ff8c2a6488c","observation_id":"941cc818-33c5-4699-b77c-971cd47c83ee","resolution":{"observed_at":"2026-08-01T22:03:47.788810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13710","last_updated":"2024-11-17T22:32:53Z","snapshot_observed_at":"2026-07-06T19:18:53.582890Z","submitted_at":"2024-09-06T16:17:06Z","title":"You can remove GPT2's LayerNorm by fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13710","snapshot_observed_at":"2026-08-01T22:03:47.847142Z","title":"arXiv preprint arXiv:2409.13710 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.847142Z"},"links":{"cited_paper":"/paper/2409.13710","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:3632de4b18293ac7ea1192c21efbeb46b0d38a884d9b7c1a99b8aa3ec7bcc120","observation_id":"dbfe7642-9732-4edd-9462-061916c160c1","resolution":{"observed_at":"2026-08-01T22:03:47.847142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:47.916209Z","title":"2022 , howpublished =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.916209Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:2fd257d1c204a534fced3abdb1072b168b8ee12029b91f65f0ccde812e883f25","observation_id":"0d312b37-4e20-47d3-9bd8-62097ea3e968","resolution":{"observed_at":"2026-08-01T22:03:47.916209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:47.991412Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:47.991412Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:155bc67f9b570536c8e8f9c929561974de46288d122b018c9809afa54c115395","observation_id":"cbb94c20-245e-4626-bac5-665a2a05b737","resolution":{"observed_at":"2026-08-01T22:03:47.991412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:48.067863Z","title":"OpenAI blog , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.067863Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:54cdd8a5fa7054c538f8c0b1c2d316266c81b203971147fdd6e91a5c3a2e8a14","observation_id":"b8ff73c2-244f-4b43-a0ec-d6747016d154","resolution":{"observed_at":"2026-08-01T22:03:48.067863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-01T22:03:48.119414Z","title":"arXiv preprint arXiv:1711.05101 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.119414Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:a72ec2655a7c16ad52a456ed97e6d482631a4d23f6476082d9777e6120ee41c4","observation_id":"a6b62e61-c1bf-403e-9820-55466bce3a08","resolution":{"observed_at":"2026-08-01T22:03:48.119414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:48.184376Z","title":"Science , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.184376Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:71834b409a3b21de645fd5e6ad605d2ef7c9c0c9964109493e3a35c89ec73e24","observation_id":"820a3553-6751-4401-b6ce-daad38e831ec","resolution":{"observed_at":"2026-08-01T22:03:48.184376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06590","last_updated":"2023-02-13T18:42:46Z","snapshot_observed_at":"2026-08-09T03:51:13.580064Z","submitted_at":"2023-02-13T18:42:46Z","title":"The Impact of AI on Developer Productivity: Evidence from GitHub Copilot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06590","snapshot_observed_at":"2026-08-01T22:03:48.226607Z","title":"arXiv preprint arXiv:2302.06590 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.226607Z"},"links":{"cited_paper":"/paper/2302.06590","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:43fcd424ecb017095543cde86cf3be600226367d85e103447edc85d95c0865c3","observation_id":"2647dea8-d7da-4cbc-b378-53407812b8f9","resolution":{"observed_at":"2026-08-01T22:03:48.226607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:48.287490Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.287490Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:bfb1a0c2b7950f975006030acfcab5317671a5c254fc8bacc544f79daed61669","observation_id":"5a212429-21d3-478b-8b8b-61e0f03ee84a","resolution":{"observed_at":"2026-08-01T22:03:48.287490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-01T22:03:48.374530Z","title":"arXiv preprint arXiv:2404.14082 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.374530Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:2c8123259a659f6be3e193dd2cbdbbafc7709f0a4fb1b78a65b81e63882b437e","observation_id":"1e48ecb1-89f7-4828-b93d-4aa2b788f028","resolution":{"observed_at":"2026-08-01T22:03:48.374530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:48.474966Z","title":"Proceedings of the 2022 CHI conference on human factors in computing systems , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.474966Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:0746ac47bf7c068f115b1231a51ff5cf351efb546745f0b9166a23acbe3b39be","observation_id":"8a377723-1b9d-4f66-8caf-dd9f3961c253","resolution":{"observed_at":"2026-08-01T22:03:48.474966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:48.565619Z","title":"Computational Linguistics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.565619Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:8b20b30ff95257cd70c2cf83b263431e3d835c747ffaa1a213256c55a2073194","observation_id":"5e851734-5997-4855-b2e6-c6c459e7fc38","resolution":{"observed_at":"2026-08-01T22:03:48.565619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:48.686604Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2022 , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.686604Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:9c76b8447351c180ecbd0cfa91ba8ec60c98d4e785bdec0a3476e14ec1931425","observation_id":"ebf14706-323d-4153-8320-a560716c1e6c","resolution":{"observed_at":"2026-08-01T22:03:48.686604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14500","last_updated":"2023-02-06T04:07:43Z","snapshot_observed_at":"2026-07-06T13:57:36.100400Z","submitted_at":"2022-09-29T01:35:57Z","title":"Bidirectional Language Models Are Also Few-shot Learners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14500","snapshot_observed_at":"2026-08-01T22:03:48.778712Z","title":"arXiv preprint arXiv:2209.14500 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.778712Z"},"links":{"cited_paper":"/paper/2209.14500","citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:b7b79664bc793005d39fb57905856845295a2376d5ba10f69f7e30670927ae63","observation_id":"2a9b1264-f772-449d-8350-10fa0fa6946b","resolution":{"observed_at":"2026-08-01T22:03:48.778712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:03:48.854674Z","title":"Computational Linguistics , volume=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T22:03:48.854674Z"},"links":{"citing_paper":"/paper/2607.15893"},"observation_digest":"sha256:3d4148cb3f341ac74ad2ae15bcc21fb59e3e6f103e51d140a94ea7ad903376c0","observation_id":"e5bcc2b3-1307-4936-80b1-a8cd8c53a24c","resolution":{"observed_at":"2026-08-01T22:03:48.854674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.15893","last_updated":"2026-07-20T09:15:04Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T03:20:22.645111Z","submitted_at":"2026-07-17T12:07:59Z","title":"Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2607.15893."}