{"as_of":"2026-08-13T19:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ce747507c928546b5cbd9f452c141711fe5960f47390b49af4acaecea0d49e48","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:20:23.832163Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:49:37.474320Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:49:40.740002Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"cited_work":{"arxiv_id":"2412.12276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.12276","snapshot_observed_at":"2026-08-07T00:49:40.740002Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","venue":"cs.CL","work_id":"10e08331-e96b-4935-bc4c-bd658c013bd1","year":2024},"citing_paper":{"arxiv_id":"2506.12796","last_updated":"2025-06-17T07:46:17Z","snapshot_observed_at":"2026-08-09T02:07:02.685178Z","submitted_at":"2025-06-15T10:04:42Z","title":"Surprise Calibration for Better In-Context Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T00:49:37.474320Z"},"links":{"cited_paper":"/paper/2412.12276","citing_paper":"/paper/2506.12796"},"observation_digest":"sha256:6a68af758e93913bf955acd734eb285702ca94410826cefa2ed47ce67c1def8d","observation_id":"bfb181bb-915d-4989-8840-f4066b212da2","resolution":{"observed_at":"2026-08-07T00:49:40.766596Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.12276/citation-record","integrity":"/paper/2412.12276/integrity","json":"/paper/2412.12276/citation-record.json","paper":"/paper/2412.12276"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.518455Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.518455Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:fd47500c07b661d24f2827d14f21244c5a81b4b7f6667d4c754449513791bc49","observation_id":"1843ef40-2b3b-41a4-bf13-f087d3d41467","resolution":{"observed_at":"2026-08-11T14:20:23.518455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.524229Z","title":"Transformers learn to implement preconditioned gradient descent for in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.524229Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:d485f44289d77142809734c39a92e6ec25013149fc0381ca0baefeeea7c8cc3e","observation_id":"6f5ce1e6-2362-41e9-baa3-346a31e385b9","resolution":{"observed_at":"2026-08-11T14:20:23.524229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08587","last_updated":"2023-09-21T14:49:20Z","snapshot_observed_at":"2026-08-13T10:12:45.724763Z","submitted_at":"2023-09-15T17:44:05Z","title":"Compositional Foundation Models for Hierarchical Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08587","snapshot_observed_at":"2026-08-11T14:20:23.528831Z","title":"Compositional foundation models for hierarchical planning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.528831Z"},"links":{"cited_paper":"/paper/2309.08587","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:07f61db6a723d8d3b2b689c66676066cd1e170f2b0647f32686ff602e904dd98","observation_id":"8352b623-d509-46f9-8ede-a5f3b3406b15","resolution":{"observed_at":"2026-08-11T14:20:23.528831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12973","last_updated":"2024-01-30T18:59:34Z","snapshot_observed_at":"2026-08-13T18:57:32.763757Z","submitted_at":"2024-01-23T18:59:21Z","title":"In-Context Language Learning: Architectures and Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12973","snapshot_observed_at":"2026-08-11T14:20:23.533846Z","title":"In-context language learning: Arhitectures and algorithms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.533846Z"},"links":{"cited_paper":"/paper/2401.12973","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:abefc276e2b6e97f18efa41c40bfce65efa18f5ea8626a3c1e8c00e22a27e877","observation_id":"b2e41798-5349-4670-bf80-9508cd864d61","resolution":{"observed_at":"2026-08-11T14:20:23.533846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-11T14:20:23.538909Z","title":"and Bengio, Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.538909Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:f3be2363522b6703d3e602092f2ef59bfdb456a3febdfc604fee74f80af016f9","observation_id":"6e0e83c8-487a-42e0-aa99-2748ad46e4c2","resolution":{"observed_at":"2026-08-11T14:20:23.538909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.543753Z","title":"Transformers as statisticians: Provable in-context learning with in-context algorithm selection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.543753Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:f3b561dee46595250daebe5eb9efe25219d30ce52adce6e431403d1a42a0ec0a","observation_id":"c1ec4d5b-d780-4f50-b8cf-69d0bc8a4577","resolution":{"observed_at":"2026-08-11T14:20:23.543753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:24.941117Z","title":"and Moore, R","venue":null,"work_id":"28aadfce-c1a0-4914-803e-c631d22f6893","year":2004},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.548428Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:70c2a6bcc15451fe3b429b37a17b4033046d7e7c6581ee806693a0f158308d84","observation_id":"e8b23984-262b-4bab-9d24-3ef8af68c49b","resolution":{"observed_at":"2026-08-11T14:20:24.945806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07830","last_updated":"2023-05-21T01:52:45Z","snapshot_observed_at":"2026-08-13T13:42:55.931048Z","submitted_at":"2022-11-15T01:13:39Z","title":"Prompting Language Models for Linguistic Structure","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.07830","snapshot_observed_at":"2026-08-11T14:20:23.553189Z","title":"Prompting language models for linguistic structure","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.553189Z"},"links":{"cited_paper":"/paper/2211.07830","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:4237dfb51720c65b264c349041ceacbc73f085078922df9ae044e4766e7c156d","observation_id":"789b99bc-0c0e-48c8-a70f-06f7db6830de","resolution":{"observed_at":"2026-08-11T14:20:23.553189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:24.926389Z","title":"Emergence of sparse representations from noise","venue":null,"work_id":"6d518c98-4a9b-4c22-8a21-5fbef6ce5430","year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.561597Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:81099121864c49a4ae9267fac8bc3aa7d3eef23f0a0c3d6aa0767ef2d1d6598d","observation_id":"e5f8f8e2-50b2-4f80-9b1b-a6ea3e1c126d","resolution":{"observed_at":"2026-08-11T14:20:24.931176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T14:20:23.566711Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.566711Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:900b1befc56c182d238f3babaa1ad263077d32c25e7963579a0266d4cea60975","observation_id":"3ecf42b0-3029-4c49-bfa4-b0560c11b1f3","resolution":{"observed_at":"2026-08-11T14:20:23.566711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-11T14:20:23.571962Z","title":"T., Li, Y., Lundberg, S., Nori, H., Palangi, H., Ribeiro, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.571962Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:ff2a7a393c6fdb107fbd392798455675733e5a2b3d750cb35ee0c3a5fc589070","observation_id":"58e24df1-393b-4c50-bafa-00f84f108776","resolution":{"observed_at":"2026-08-11T14:20:23.571962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12831","last_updated":"2024-10-21T08:55:49Z","snapshot_observed_at":"2026-08-12T23:29:37.447699Z","submitted_at":"2024-07-03T13:01:54Z","title":"Truth is Universal: Robust Detection of Lies in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12831","snapshot_observed_at":"2026-08-11T14:20:23.579453Z","title":"A., and Nadler, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.579453Z"},"links":{"cited_paper":"/paper/2407.12831","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:be6b068b52b87c17bad0f6c1c30642b43d23d9748a1e1b198e4a07812c597fd8","observation_id":"967a51ce-6d57-436d-8ac3-15bccb9c1f1a","resolution":{"observed_at":"2026-08-11T14:20:23.579453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.584116Z","title":"R., Muti, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.584116Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:0849894b75d9c522dd37ac11b25b05e77fca327fc33a7b46e1a94069a3e90dce","observation_id":"7a626177-4f91-484c-906f-dbad86508d1d","resolution":{"observed_at":"2026-08-11T14:20:23.584116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-11T14:20:23.588539Z","title":"Sparse autoencoders find highly interpretable features in language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.588539Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:b5092849d1b23a6025cb09691f2b0f3c865cd1d714d8b92de27b6cfc849f278d","observation_id":"e5791223-b2b6-4060-b1bd-0f1bd961e5c8","resolution":{"observed_at":"2026-08-11T14:20:23.588539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10559","last_updated":"2023-05-15T11:45:12Z","snapshot_observed_at":"2026-08-13T13:17:49.818952Z","submitted_at":"2022-12-20T18:58:48Z","title":"Why Can GPT Learn In-Context? Language Models Implicitly Perform Gradient Descent as Meta-Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10559","snapshot_observed_at":"2026-08-11T14:20:23.592776Z","title":"Why can gpt learn in-context? language models implicitly perform gradient descent as meta-optimizers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.592776Z"},"links":{"cited_paper":"/paper/2212.10559","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:d8be37f5dc4b32cc7a0db96d56b64bee488de98c9f0db108adb9a2457697f8e2","observation_id":"c1424f37-f9e1-408e-affd-44fa7ab1b715","resolution":{"observed_at":"2026-08-11T14:20:23.592776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.07237","last_updated":"2022-05-15T09:45:34Z","snapshot_observed_at":"2026-08-13T15:43:53.656303Z","submitted_at":"2022-05-15T09:45:34Z","title":"Discovering Latent Concepts Learned in BERT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.07237","snapshot_observed_at":"2026-08-11T14:20:23.596712Z","title":"R., Alam, F., Durrani, N., Xu, J., and Sajjad, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.596712Z"},"links":{"cited_paper":"/paper/2205.07237","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:ddf8e658e65af1e5db570a570304aeee78cbdfaac6a20b08ac24289725a15f0a","observation_id":"804fdf38-2340-445c-8583-1b2a192b8439","resolution":{"observed_at":"2026-08-11T14:20:23.596712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18654","last_updated":"2023-10-31T16:35:07Z","snapshot_observed_at":"2026-08-13T11:29:54.889059Z","submitted_at":"2023-05-29T23:24:14Z","title":"Faith and Fate: Limits of Transformers on Compositionality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18654","snapshot_observed_at":"2026-08-11T14:20:23.601076Z","title":"L., Jiang, L., Lin, B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.601076Z"},"links":{"cited_paper":"/paper/2305.18654","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:6280367b36cf3e136f364f3a8101cc9b1ac02d89a25e11018c6963f1f85d0663","observation_id":"ef26be57-87c3-4a40-b51b-51f188ecd554","resolution":{"observed_at":"2026-08-11T14:20:23.601076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-11T14:20:23.605333Z","title":"The pile: An 800gb dataset of diverse text for language modeling, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.605333Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:7a8e17f5459949509cb3e0479efe60e20faa60dd9b6858e7579a42efb2cd6efd","observation_id":"cf465b21-e766-40db-8b25-3906a042abb9","resolution":{"observed_at":"2026-08-11T14:20:23.605333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.609618Z","title":"S., and Valiant, G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.609618Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:582893aabfa7099a6bbdb8806b33e3b37a8d77fd7a37d958a000c6e98e5cb11e","observation_id":"a3ecdc4c-0b71-495b-86fb-1a18ba809d5a","resolution":{"observed_at":"2026-08-11T14:20:23.609618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14623","last_updated":"2020-11-21T01:53:49Z","snapshot_observed_at":"2026-08-12T20:52:30.832885Z","submitted_at":"2020-04-30T07:53:20Z","title":"Neural Natural Language Inference Models Partially Embed Theories of Lexical Entailment and Negation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14623","snapshot_observed_at":"2026-08-11T14:20:23.613871Z","title":"Neural natural language inference models partially embed theories of lexical entailment and negation","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.613871Z"},"links":{"cited_paper":"/paper/2004.14623","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:6f6f2284f4cf23f321a18500bd0f4aaa0cbb80b14ad16170ebd1641d68c61620","observation_id":"8736e315-6d2a-4c61-8066-c2a4c5e847a6","resolution":{"observed_at":"2026-08-11T14:20:23.613871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T14:20:23.618355Z","title":"Gemma 2: Improving open language models at a practical size, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.618355Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:d2f77c75d1a9014729bddcbdb37947d6602e2ec2adef490e34775464affe12e9","observation_id":"8d718f05-e15d-427b-8776-7f14d385b177","resolution":{"observed_at":"2026-08-11T14:20:23.618355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:24.902272Z","title":"Is mamba capable of in-context learning?, 2024","venue":null,"work_id":"3c2cf74f-d236-4d3e-8c08-b11144f12622","year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.622942Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:65448d58ac9188f8c8eb968cc2f6cee4ce9bd355b8f03308f965a70cd9f3255d","observation_id":"4f4b3e2b-58ee-4a61-a525-5e654a250462","resolution":{"observed_at":"2026-08-11T14:20:24.907151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-11T14:20:23.627497Z","title":"H., Ivison, H., Magnusson, I., Wang, Y., Arora, S., Atkinson, D., Authur, R., Chandu, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.627497Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:b5c31d42a1807e51f70173c3db0742b3715d9c902da64677ada1ae424e208242","observation_id":"cbed37b3-2fb4-494c-9b20-758f3bfee578","resolution":{"observed_at":"2026-08-11T14:20:23.627497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:24.887445Z","title":"and Dao, T","venue":null,"work_id":"e17463e9-c032-4464-898e-bd8acea6b725","year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.632068Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:3fc02dab10832a33b91459536e6f6c905b55f2991a035bc87c08a5504852e8eb","observation_id":"86c45169-a28b-4f40-a1d6-35e7f0669677","resolution":{"observed_at":"2026-08-11T14:20:24.892120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02207","last_updated":"2024-03-04T18:25:29Z","snapshot_observed_at":"2026-08-13T05:58:14.954758Z","submitted_at":"2023-10-03T17:06:52Z","title":"Language Models Represent Space and Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02207","snapshot_observed_at":"2026-08-11T14:20:23.636661Z","title":"and Tegmark, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.636661Z"},"links":{"cited_paper":"/paper/2310.02207","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:8c18031a3a42be5966b41a40a80d5f6b069c60a47e7075eeb7912e5cf97cac01","observation_id":"514e9903-df9a-462e-8d92-88c2681d8d18","resolution":{"observed_at":"2026-08-11T14:20:23.636661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06639","last_updated":"2024-05-10T17:59:04Z","snapshot_observed_at":"2026-08-13T00:10:04.134986Z","submitted_at":"2024-05-10T17:59:04Z","title":"Value Augmented Sampling for Language Model Alignment and Personalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06639","snapshot_observed_at":"2026-08-11T14:20:23.641335Z","title":"Value augmented sampling for language model alignment and personalization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.641335Z"},"links":{"cited_paper":"/paper/2405.06639","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:47608a72c6bbc3857d347fc8366104c467f04ddcdaf3a417692b1ed0faab526d","observation_id":"28d2cee9-c5cc-4f25-a1ef-db8916fa8979","resolution":{"observed_at":"2026-08-11T14:20:23.641335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02550","last_updated":"2024-11-04T16:04:27Z","snapshot_observed_at":"2026-08-12T23:50:15.152932Z","submitted_at":"2024-06-04T17:59:36Z","title":"Learning to grok: Emergence of in-context learning and skill composition in modular arithmetic tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02550","snapshot_observed_at":"2026-08-11T14:20:23.645794Z","title":"Learning to grok: Emergence of in-context learning and skill composition in modular arithmetic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.645794Z"},"links":{"cited_paper":"/paper/2406.02550","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:7dd4f855f08dd879100d921566c41896b853fb99c8abcf66bf12cd8eb84374c9","observation_id":"24371c62-2602-49e4-ae2f-308017a7ad95","resolution":{"observed_at":"2026-08-11T14:20:23.645794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15255","last_updated":"2024-04-23T17:42:29Z","snapshot_observed_at":"2026-08-12T21:46:28.191953Z","submitted_at":"2024-04-23T17:42:29Z","title":"How to use and interpret activation patching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15255","snapshot_observed_at":"2026-08-11T14:20:23.650464Z","title":"and Nanda, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.650464Z"},"links":{"cited_paper":"/paper/2404.15255","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:7b02e05969df6aa2f6a47d1d9b962a849ef372412ae188eb5903db70b3491212","observation_id":"5537ed2f-1692-484e-87b4-133102f540a0","resolution":{"observed_at":"2026-08-11T14:20:23.650464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15916","last_updated":"2023-10-24T15:17:14Z","snapshot_observed_at":"2026-08-13T05:42:05.425097Z","submitted_at":"2023-10-24T15:17:14Z","title":"In-Context Learning Creates Task Vectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15916","snapshot_observed_at":"2026-08-11T14:20:23.655016Z","title":"In-context learning creates task vectors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.655016Z"},"links":{"cited_paper":"/paper/2310.15916","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:c346d702215e785b6acec14d5143778f5837a2d57d0a9e854cb1e3fa6a8c11dd","observation_id":"07927898-cc89-458a-95cb-76b417a0ddf0","resolution":{"observed_at":"2026-08-11T14:20:23.655016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12442","last_updated":"2024-09-26T11:15:14Z","snapshot_observed_at":"2026-08-13T02:38:11.446919Z","submitted_at":"2024-06-18T09:46:44Z","title":"Abstraction-of-Thought Makes Language Models Better Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12442","snapshot_observed_at":"2026-08-11T14:20:23.660221Z","title":"Abstraction-of-thought makes language models better reasoners","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.660221Z"},"links":{"cited_paper":"/paper/2406.12442","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:c3f525ec4f2880c7723fdf43c35905e635d34fbee06590672ac7140248477dbe","observation_id":"6449fbd5-622d-4696-ad15-9f2f3c92a8dc","resolution":{"observed_at":"2026-08-11T14:20:23.660221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01748","last_updated":"2024-10-02T17:01:10Z","snapshot_observed_at":"2026-08-12T22:32:20.510656Z","submitted_at":"2024-10-02T17:01:10Z","title":"Not All LLM Reasoners Are Created Equal","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01748","snapshot_observed_at":"2026-08-11T14:20:23.664955Z","title":"Not all llm reasoners are created equal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.664955Z"},"links":{"cited_paper":"/paper/2410.01748","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:f16150c0ec72e49e512fd44a1ad23a4287644cb8570d694f96fa7ab5a6244168","observation_id":"c2452abc-0f07-460e-bcbb-8b22c878c49e","resolution":{"observed_at":"2026-08-11T14:20:23.664955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T14:20:23.669122Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.669122Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:ee62c66f873108eb81875ec4280890a52de2b8168b85f35ba198c36034b0ad28","observation_id":"69e5f5c2-4650-4295-93a3-07a790ac23ca","resolution":{"observed_at":"2026-08-11T14:20:23.669122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07987","last_updated":"2024-07-25T09:33:50Z","snapshot_observed_at":"2026-08-06T11:02:06.607024Z","submitted_at":"2024-05-13T17:58:30Z","title":"The Platonic Representation Hypothesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07987","snapshot_observed_at":"2026-08-11T14:20:23.673226Z","title":"The platonic representation hypothesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.673226Z"},"links":{"cited_paper":"/paper/2405.07987","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:581f2af22f14cd9f5b613780c3f8e978c7f36a232218aded0bf2472b7fcec2d4","observation_id":"619add4e-6f67-4bc6-96d0-c0ad373a8fdb","resolution":{"observed_at":"2026-08-11T14:20:23.673226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16236","last_updated":"2020-08-31T11:09:32Z","snapshot_observed_at":"2026-08-06T23:24:28.908251Z","submitted_at":"2020-06-29T17:55:38Z","title":"Transformers are RNNs: Fast Autoregressive Transformers with Linear Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16236","snapshot_observed_at":"2026-08-11T14:20:23.677375Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.677375Z"},"links":{"cited_paper":"/paper/2006.16236","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:076dde282a48a20059edf31d58aac7d3b4b8fefcd8d937efeac065a6e5731096","observation_id":"755603ec-22a7-42a6-ab0b-be751e460387","resolution":{"observed_at":"2026-08-11T14:20:23.677375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T14:20:23.681795Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.681795Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:d1baf62a0a38c7e12cb148d10a71361c027a09d39ae9f9aa4f50c1dc0393dbb3","observation_id":"77a8c60d-733a-406d-ad02-667346bfba45","resolution":{"observed_at":"2026-08-11T14:20:23.681795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10054","last_updated":"2022-02-21T09:03:34Z","snapshot_observed_at":"2026-08-13T16:37:33.949862Z","submitted_at":"2022-02-21T09:03:34Z","title":"Fine-Tuning can Distort Pretrained Features and Underperform Out-of-Distribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10054","snapshot_observed_at":"2026-08-11T14:20:23.686376Z","title":"Fine-tuning can distort pretrained features and underperform out-of-distribution, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.686376Z"},"links":{"cited_paper":"/paper/2202.10054","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:1d2e3a957b6efe7f8b7687828772ef8629bca09a5e042e9fe3fcfa4e977fbbad","observation_id":"2f289074-b19a-4549-8e9c-2a4234d937e1","resolution":{"observed_at":"2026-08-11T14:20:23.686376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03618","last_updated":"2024-02-06T01:07:56Z","snapshot_observed_at":"2026-08-13T04:25:35.394856Z","submitted_at":"2024-02-06T01:07:56Z","title":"Comparing Abstraction in Humans and Large Language Models Using Multimodal Serial Reproduction","version":1},"cited_work":{"arxiv_id":"2402.03618","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.03618","snapshot_observed_at":"2026-08-11T14:20:24.343413Z","title":"Comparing Abstraction in Humans and Large Language Models Using Multimodal Serial Reproduction","venue":"cs.AI","work_id":"a74ef9fd-bd32-464c-854b-78eda4b33c9a","year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.690975Z"},"links":{"cited_paper":"/paper/2402.03618","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:6c2bf0a7aa2119ccb2ebcb5ba867c596cd757e7993b8ebdb43aacfc638c72886","observation_id":"01267c36-db16-4a1d-8c6e-3e8846bd30a0","resolution":{"observed_at":"2026-08-11T14:20:24.348720Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02028","last_updated":"2024-07-02T07:52:30Z","snapshot_observed_at":"2026-08-12T23:30:39.186493Z","submitted_at":"2024-07-02T07:52:30Z","title":"Why does in-context learning fail sometimes? Evaluating in-context learning on open and closed questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02028","snapshot_observed_at":"2026-08-11T14:20:23.695804Z","title":"Why does in-context learning fail sometimes? evaluating in-context learning on open and closed questions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.695804Z"},"links":{"cited_paper":"/paper/2407.02028","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:0f1a4842e0f7a48637925078c9a6467f0854ed2ced098d202882015cf23bdb78","observation_id":"4cf8ddd5-40c7-4ae6-ac6f-a1cdcda7aaf5","resolution":{"observed_at":"2026-08-11T14:20:23.695804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.700458Z","title":"E., Papailiopoulos, D., and Oymak, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.700458Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:cbffc21f57732127722b21897670c44a31d3ea25b474eaf572ad58c7b168dc86","observation_id":"bee98c39-6359-439a-bf28-4a8b942ddb76","resolution":{"observed_at":"2026-08-11T14:20:23.700458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12785","last_updated":"2023-11-21T18:51:03Z","snapshot_observed_at":"2026-08-13T05:20:13.204910Z","submitted_at":"2023-11-21T18:51:03Z","title":"Prompting Frameworks for Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12785","snapshot_observed_at":"2026-08-11T14:20:23.704821Z","title":"Prompting frameworks for large language models: A survey, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.704821Z"},"links":{"cited_paper":"/paper/2311.12785","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:a3fd54b67e57ae842c29e3698794e2dd0011fdc04cb7661019eefe6caf595e7e","observation_id":"39a86a29-a058-46de-8290-413d31bfc3e2","resolution":{"observed_at":"2026-08-11T14:20:23.704821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:24.862873Z","title":"A., MacIntyre, R., Bies, A., Ferguson, M., Katz, K., and Schasberger, B","venue":null,"work_id":"53317994-cf7b-459f-9d44-c2c25f3694dc","year":1994},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.709698Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:8c82c4c45533b04b83655830859ffb19e78c54be0fb146690914686940a755fd","observation_id":"aa3032ee-0bd6-4480-acc8-f5da6dd169f1","resolution":{"observed_at":"2026-08-11T14:20:24.867669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:24.847496Z","title":"and Tegmark, M","venue":null,"work_id":"50881801-093a-4844-b8d1-3b37add33c6a","year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.714355Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:eec81006f575d3d05369c1dbcca5824a98af156c38b05d5944c719f595f61d1c","observation_id":"1ae89b0e-6f25-45a8-a2aa-f400dc659e9d","resolution":{"observed_at":"2026-08-11T14:20:24.852439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09003","last_updated":"2025-01-28T03:59:40Z","snapshot_observed_at":"2026-08-13T01:35:24.874459Z","submitted_at":"2024-11-13T20:12:55Z","title":"Refusal in LLMs is an Affine Function","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09003","snapshot_observed_at":"2026-08-11T14:20:23.719191Z","title":"Refusal in llms is an affine function, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.719191Z"},"links":{"cited_paper":"/paper/2411.09003","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:075b9155d47af3efd056d60d30bb7a2779f3ad6bcbfe79a384687e95a723822b","observation_id":"228af131-7ddd-42a7-8a04-9e950ba3f093","resolution":{"observed_at":"2026-08-11T14:20:23.719191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16130","last_updated":"2024-04-03T16:27:31Z","snapshot_observed_at":"2026-08-13T11:33:20.634753Z","submitted_at":"2023-05-25T15:04:01Z","title":"Language Models Implement Simple Word2Vec-style Vector Arithmetic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16130","snapshot_observed_at":"2026-08-11T14:20:23.723901Z","title":"Language models implement simple word2vec-style vector arithmetic","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.723901Z"},"links":{"cited_paper":"/paper/2305.16130","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:4c289bbc0a6ae72409bb15b43138b1c452d0ee498751a39d4c95d95d17bd95cd","observation_id":"483aa916-43de-4681-9f72-6d84c678ed78","resolution":{"observed_at":"2026-08-11T14:20:23.723901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08744","last_updated":"2024-05-06T14:31:32Z","snapshot_observed_at":"2026-08-13T05:50:14.707045Z","submitted_at":"2023-10-12T22:12:28Z","title":"Circuit Component Reuse Across Tasks in Transformer Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08744","snapshot_observed_at":"2026-08-11T14:20:23.728824Z","title":"Circuit component reuse across tasks in transformer language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.728824Z"},"links":{"cited_paper":"/paper/2310.08744","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:077b8a63000e0648e827149672f28351fa1e6ac8332247d931f35889dd3cff9c","observation_id":"904d5ade-6cc9-40f0-9e6c-807d3fa02b38","resolution":{"observed_at":"2026-08-11T14:20:23.728824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12837","last_updated":"2022-10-20T14:04:10Z","snapshot_observed_at":"2026-08-01T15:23:39.998892Z","submitted_at":"2022-02-25T17:25:19Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12837","snapshot_observed_at":"2026-08-11T14:20:23.733382Z","title":"Rethinking the role of demonstrations: What makes in-context learning work?, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.733382Z"},"links":{"cited_paper":"/paper/2202.12837","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:4e660cf06ca436c76b670b785e385c4e070e0ac1e82c3dc9de7ac206886e1d4a","observation_id":"d55fc90d-41fd-4eb8-9abd-4b805dd8c98b","resolution":{"observed_at":"2026-08-11T14:20:23.733382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19162","last_updated":"2025-06-14T23:01:59Z","snapshot_observed_at":"2026-08-12T23:55:06.360029Z","submitted_at":"2024-05-29T15:06:10Z","title":"Does learning the right latent variables necessarily improve in-context learning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19162","snapshot_observed_at":"2026-08-11T14:20:23.737932Z","title":"Does learning the right latent variables necessarily improve in-context learning? arXiv preprint arXiv:2405.19162, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.737932Z"},"links":{"cited_paper":"/paper/2405.19162","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:f91b2dcd100a6b56fd35ac62b88513de5a278d13922eda5fbda1d739772df116","observation_id":"7943f1f1-f72b-43ce-822b-ed696219173e","resolution":{"observed_at":"2026-08-11T14:20:23.737932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-11T14:20:23.742203Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.742203Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:bfe1a7bbc34842e029a68c1e113b460688f86cd59e8057a8edbde420cae7c392","observation_id":"4a46f22f-0aaf-441e-8504-d93003230e59","resolution":{"observed_at":"2026-08-11T14:20:23.742203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19370","last_updated":"2024-12-11T07:53:57Z","snapshot_observed_at":"2026-08-12T23:33:24.909710Z","submitted_at":"2024-06-27T17:50:05Z","title":"Emergence of Hidden Capabilities: Exploring Learning Dynamics in Concept Space","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19370","snapshot_observed_at":"2026-08-11T14:20:23.746808Z","title":"F., Okawa, M., Lee, A., Lubana, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.746808Z"},"links":{"cited_paper":"/paper/2406.19370","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:3d6011408adc8cd78be13dc0fdd8009642a52bd7bd01cffcb2ce09208b48bf67","observation_id":"1648731c-fbc7-4cfe-acf4-bddecc3c4d9c","resolution":{"observed_at":"2026-08-11T14:20:23.746808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08559","last_updated":"2024-05-22T14:35:15Z","snapshot_observed_at":"2026-08-13T05:50:24.172746Z","submitted_at":"2023-10-12T17:51:10Z","title":"Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08559","snapshot_observed_at":"2026-08-11T14:20:23.750905Z","title":"Phenomenal yet puzzling: Testing inductive reasoning capabilities of language models with hypothesis refinement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.750905Z"},"links":{"cited_paper":"/paper/2310.08559","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:85c974424424d2cfcd364200f582165e7483cf1170fc874072f32e259cd99178","observation_id":"8823662a-5cd3-41ca-8ef5-438fe68bd6f1","resolution":{"observed_at":"2026-08-11T14:20:23.750905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.755918Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.755918Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:bae27ebbb1d3c3b5094af7165f908d0f9ffbddde597c1ed40cd9a79567720efb","observation_id":"dd6ad1d7-6ab1-4ab7-89a3-aebbc2315d06","resolution":{"observed_at":"2026-08-11T14:20:23.755918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:24.822394Z","title":"Pretraining task diversity and the emergence of non-bayesian in-context learning for regression","venue":null,"work_id":"0f2821c3-8d81-4060-a992-eb32a1354c2f","year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.760605Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:875fdcdd52c6f01c7c29929faa94117eb8d5393b903f321e7b0127175f2d21b1","observation_id":"edfc400a-ddd3-480d-9ac4-4f0a9327e169","resolution":{"observed_at":"2026-08-11T14:20:24.827343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07206","last_updated":"2022-05-24T02:08:16Z","snapshot_observed_at":"2026-08-13T16:40:40.274437Z","submitted_at":"2022-02-15T05:43:54Z","title":"Impact of Pretraining Term Frequencies on Few-Shot Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07206","snapshot_observed_at":"2026-08-11T14:20:23.764916Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.764916Z"},"links":{"cited_paper":"/paper/2202.07206","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:a4a5a0459861b63a89fdfdc6ddaba1c4befeb2860ec70b754e475eb9d3a878de","observation_id":"c65ee23b-a078-4595-8481-bd60a9d79cee","resolution":{"observed_at":"2026-08-11T14:20:23.764916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:24.806998Z","title":"On convergence of nearest neighbor classifiers over feature transformations","venue":null,"work_id":"de34ffe4-2865-4250-b669-278561dedb77","year":2020},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.769406Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:e5970b2a5dfae22a8c702d92a5c01b12d18465bb04d1f330b391d8643aa406f3","observation_id":"3a662fdd-77a4-41b1-a104-0bffe901321b","resolution":{"observed_at":"2026-08-11T14:20:24.811959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00159","last_updated":"2024-06-06T18:46:40Z","snapshot_observed_at":"2026-08-13T04:29:45.563095Z","submitted_at":"2024-01-31T20:29:50Z","title":"Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00159","snapshot_observed_at":"2026-08-11T14:20:23.773670Z","title":"Dolma: An open corpus of three trillion tokens for language model pretraining research","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.773670Z"},"links":{"cited_paper":"/paper/2402.00159","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:5c4c4c8c5bcbd73c2fb43ba90ae9333d98b7b1b1a25279e7893497ccf2e0443e","observation_id":"c822efef-3e8d-418a-aeac-ee784947b929","resolution":{"observed_at":"2026-08-11T14:20:23.773670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15213","last_updated":"2024-02-25T18:32:18Z","snapshot_observed_at":"2026-08-13T05:42:53.020730Z","submitted_at":"2023-10-23T17:55:24Z","title":"Function Vectors in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15213","snapshot_observed_at":"2026-08-11T14:20:23.778362Z","title":"L., Sharma, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.778362Z"},"links":{"cited_paper":"/paper/2310.15213","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:99cbc81cf699067698a19247d0046bd71c1526e42a544d16bc8746f47ff813f0","observation_id":"783b8b71-cdc5-4cf7-87e7-803b1422d4e9","resolution":{"observed_at":"2026-08-11T14:20:23.778362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12265","last_updated":"2020-11-22T07:58:08Z","snapshot_observed_at":"2026-08-10T09:04:33.884910Z","submitted_at":"2020-04-26T01:53:03Z","title":"Causal Mediation Analysis for Interpreting Neural NLP: The Case of Gender Bias","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.12265","snapshot_observed_at":"2026-08-11T14:20:23.783012Z","title":"Causal mediation analysis for interpreting neural nlp: The case of gender bias, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.783012Z"},"links":{"cited_paper":"/paper/2004.12265","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:44fd1a4d1740d3f1647e5ad5549638dd8e7720ab3435353b76c5f5bd5dca185c","observation_id":"a0d7e176-a70c-4f08-bf05-3ef49b5e27af","resolution":{"observed_at":"2026-08-11T14:20:23.783012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07677","last_updated":"2023-05-31T08:59:47Z","snapshot_observed_at":"2026-08-13T13:20:59.322347Z","submitted_at":"2022-12-15T09:21:21Z","title":"Transformers learn in-context by gradient descent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07677","snapshot_observed_at":"2026-08-11T14:20:23.787636Z","title":"Transformers learn in-context by gradient descent, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.787636Z"},"links":{"cited_paper":"/paper/2212.07677","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:fb50873f2438b2abf187eedb45de287536caa6b754debf9acbce43b92c37667f","observation_id":"cb185528-a245-4a6d-874a-9e9490c651b1","resolution":{"observed_at":"2026-08-11T14:20:23.787636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.792570Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.792570Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:4efcc796b22cb4c7e22277dfcba07c637a8c7bfa220e88eb329c7fd50642771d","observation_id":"0a6e8c7d-0d50-4af2-b3a9-c239babd940e","resolution":{"observed_at":"2026-08-11T14:20:23.792570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.797708Z","title":"Transformers: State-of-the-art natural language processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.797708Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:70a1d9cb3e54e27730358dbe98ee47269a8af9f51e8f39abd9cf690deeb35b5f","observation_id":"95c54524-fd79-4d5f-a6b8-9d2845acfb7e","resolution":{"observed_at":"2026-08-11T14:20:23.797708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03592","last_updated":"2024-05-22T17:52:31Z","snapshot_observed_at":"2026-08-13T00:37:34.399753Z","submitted_at":"2024-04-04T17:00:37Z","title":"ReFT: Representation Finetuning for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03592","snapshot_observed_at":"2026-08-11T14:20:23.801832Z","title":"D., and Potts, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.801832Z"},"links":{"cited_paper":"/paper/2404.03592","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:9139011793e07adb052ccabd76435d011e3193ecf665aa45fc6b0970403f66f0","observation_id":"6eb5bb08-c089-4b07-a60f-7448daf9a5a8","resolution":{"observed_at":"2026-08-11T14:20:23.801832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02080","last_updated":"2022-07-21T07:44:13Z","snapshot_observed_at":"2026-08-10T22:45:29.185791Z","submitted_at":"2021-11-03T09:12:33Z","title":"An Explanation of In-context Learning as Implicit Bayesian Inference","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02080","snapshot_observed_at":"2026-08-11T14:20:23.806242Z","title":"M., Raghunathan, A., Liang, P., and Ma, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.806242Z"},"links":{"cited_paper":"/paper/2111.02080","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:f1a7bc166753995c6fe304d23bb9979e944aefa2496aaef70c429a56fc53d463","observation_id":"0a6897ed-4e37-4574-9ba4-c6df2443489e","resolution":{"observed_at":"2026-08-11T14:20:23.806242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03307","last_updated":"2024-11-28T17:48:55Z","snapshot_observed_at":"2026-08-12T23:07:41.137115Z","submitted_at":"2024-08-06T17:16:10Z","title":"Exchangeable Sequence Models Quantify Uncertainty Over Latent Concepts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03307","snapshot_observed_at":"2026-08-11T14:20:23.810795Z","title":"Pre-training and in-context learning is bayesian inference a la de finetti","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.810795Z"},"links":{"cited_paper":"/paper/2408.03307","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:45bb36df28dc1a89ebd0e96fa5c53058a9086ccbfbd8b8feddc13b745b69d402","observation_id":"90d3720c-2d96-490a-9b7f-bd5b900f13ba","resolution":{"observed_at":"2026-08-11T14:20:23.810795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06117","last_updated":"2024-03-12T04:38:27Z","snapshot_observed_at":"2026-08-13T05:53:33.533042Z","submitted_at":"2023-10-09T19:48:55Z","title":"Take a Step Back: Evoking Reasoning via Abstraction in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06117","snapshot_observed_at":"2026-08-11T14:20:23.815284Z","title":"S., Mishra, S., Chen, X., Cheng, H.-T., Chi, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.815284Z"},"links":{"cited_paper":"/paper/2310.06117","citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:25f2813d2a3224bda1bb35607a1041ff6bf9ea9ab60987351892e7fc8e053475","observation_id":"c8f4fbb8-f955-4d59-9901-11132ee32d10","resolution":{"observed_at":"2026-08-11T14:20:23.815284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0004-3702(99)00008-9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.867145Z","title":"Learning by discovering concept hierarchies","venue":null,"work_id":"184234f5-a262-42fb-953a-a362f9203f38","year":1999},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.819493Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:90dd999c802cd55bb6bcd4aa18fd7f65ad833dc87c616dce31e022d45524cea3","observation_id":"22519421-994d-419f-97fb-aacf97ec3ad8","resolution":{"observed_at":"2026-08-11T14:20:23.882884Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.823600Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.823600Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:81ab36025506642567f2576bbb8dce9a00fa41722cfb88cacac3f6f56d5ad788","observation_id":"eef3199f-7682-4913-81ed-ed2d3c53a61a","resolution":{"observed_at":"2026-08-11T14:20:23.823600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.828114Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.828114Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:67125ee7e5b577b64998240976f19f304d2f4ced0a961418f01e8b2d900b4f7a","observation_id":"0efeb16d-ae61-415a-8c61-446e5defc8d1","resolution":{"observed_at":"2026-08-11T14:20:23.828114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:20:23.832163Z","title":"common structure","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T14:20:23.832163Z"},"links":{"citing_paper":"/paper/2412.12276"},"observation_digest":"sha256:7bc72d42e68146670791005e852c3721cb9b4b42485ec3c6bfaa0aaf8919de47","observation_id":"75ace052-4239-42fb-9df2-7b98ab7d5824","resolution":{"observed_at":"2026-08-11T14:20:23.832163Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12276","last_updated":"2025-06-02T12:55:12Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T14:47:16.369608Z","submitted_at":"2024-12-16T19:00:18Z","title":"Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":57,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 1 inbound Pith citation observation for arXiv:2412.12276."}