{"as_of":"2026-08-11T07:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bef92c8272e79391da94c53b4e32de1714c649b0b9e2a1b6e686f1ab28abe3cd","coverage":[{"denominator":91,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":91,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:06:14.591107Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.15708/citation-record","integrity":"/paper/2501.15708/integrity","json":"/paper/2501.15708/citation-record.json","paper":"/paper/2501.15708"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-10T14:06:14.122087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.122087Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:067521c3aa81a26ddd57cc6b3e975554b2274037db0ab2c8636c8245508663c4","observation_id":"fab50a31-0808-4607-92c2-6badf9cb9a6c","resolution":{"observed_at":"2026-08-10T14:06:14.122087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12406","last_updated":"2024-01-22T23:35:09Z","snapshot_observed_at":"2026-08-09T19:21:16.399052Z","submitted_at":"2024-01-22T23:35:09Z","title":"Enhancing In-context Learning via Linear Probe Calibration","version":1},"cited_work":{"arxiv_id":"2401.12406","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.12406","snapshot_observed_at":"2026-08-10T14:06:15.795813Z","title":"Enhancing In-context Learning via Linear Probe Calibration","venue":"cs.CL","work_id":"0721297d-2578-4c60-8b32-69137a2dc079","year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.128102Z"},"links":{"cited_paper":"/paper/2401.12406","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:04320a77935eaf31efc70ec1aec8e3703c1a82df838ee6211c1ffb7fcd7a4c51","observation_id":"3ef4e3c5-7760-4afb-be14-5f2f7fca4a92","resolution":{"observed_at":"2026-08-10T14:06:15.801703Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.133818Z","title":"Falcon-40B : an open large language model with state-of-the-art performance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.133818Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:41615708216bf706a64debeb09727570c75e4d666a938b29e9e02b65b6f1db2b","observation_id":"4d74e87d-0ec6-4000-b988-30d2fe55dc37","resolution":{"observed_at":"2026-08-10T14:06:14.133818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-540-76298-0_52.pdf","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.669155Z","title":"Dbpedia: A nucleus for a web of open data","venue":null,"work_id":"26f8bd07-dab3-4b8a-b084-5aa6c01372d1","year":2007},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.138462Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:83a14be60f48c2083937fb6551a4ea6be8b255ad6cea30f3c2fbaab6a303bf23","observation_id":"490b480c-7bb5-4491-8e0d-7afd6c3d093f","resolution":{"observed_at":"2026-08-10T14:06:14.676988Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.142984Z","title":"Explaining neural scaling laws","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.142984Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:dc74fa76700d1bb719f5401f3c6353bc1f292b4080cb73bafe44e209c6ddf40b","observation_id":"9cccf4e3-84e7-45a1-972f-f99940e653aa","resolution":{"observed_at":"2026-08-10T14:06:14.142984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-10T14:06:14.148217Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.148217Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:7691c0d1d29a29721bd49bccd4ea7d0a6a4b10eb55382f0ec80e09589d3774fa","observation_id":"32667a1b-562c-402d-8671-563618113a8b","resolution":{"observed_at":"2026-08-10T14:06:14.148217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.153882Z","title":"S em E val-2019 task 5: Multilingual detection of hate speech against immigrants and women in T witter","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.153882Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:cf8ac89abb53ff6dcf9089fa974d9ba7f44ab2860ad7a4ba15b8854762f63c94","observation_id":"b09f5de5-5164-4882-8f5b-f7fc054a988e","resolution":{"observed_at":"2026-08-10T14:06:14.153882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.159278Z","title":"The fifth pascal recognizing textual entailment challenge","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.159278Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:ff021f4bb421c22c4bec732a067709f5b9ac79de780c5907e9c1a0efa69935c6","observation_id":"90a2bf73-d1c5-4077-a365-c2eab8463a02","resolution":{"observed_at":"2026-08-10T14:06:14.159278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-07T23:49:29.478548Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-10T14:06:14.166146Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.166146Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:a6562330afe86b3a5be57fd1826f50b6a77e88ec95b27cdc5fce78667778d137","observation_id":"7a946cb1-f80a-4b35-8d35-631c096e5f2b","resolution":{"observed_at":"2026-08-10T14:06:14.166146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.171058Z","title":"GPT-Neo: Large Scale Autoregressive Language Modeling with Mesh-Tensorflow , March 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.171058Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:1632fbf6b5e7edd370b5705dd3d57aab9487a06cbf15094f9d6c2665f37667f0","observation_id":"26081cdc-a5e1-47d0-824b-835f1b157483","resolution":{"observed_at":"2026-08-10T14:06:14.171058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.174918Z","title":"Icl-markup: Structuring in-context learning using soft-token tags","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.174918Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:b425834d46878586e47f45b779a38df34465467e8091f60e2f32dacf53754fae","observation_id":"0dcdf095-0e65-4a4d-be73-4d19ba3ea67a","resolution":{"observed_at":"2026-08-10T14:06:14.174918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07661","last_updated":"2024-01-27T08:07:34Z","snapshot_observed_at":"2026-08-09T20:06:16.162842Z","submitted_at":"2022-09-16T00:52:34Z","title":"On the Relation between Sensitivity and Accuracy in In-context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07661","snapshot_observed_at":"2026-08-10T14:06:14.178185Z","title":"On the relation between sensitivity and accuracy in in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.178185Z"},"links":{"cited_paper":"/paper/2209.07661","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:fe21c9aa18e0a3ff3f037a488d3dc2b3e4201651bd0985f5d36ee848c800e313","observation_id":"b6d517bd-c69d-4840-b92a-cf9ce0049ee2","resolution":{"observed_at":"2026-08-10T14:06:14.178185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16535","last_updated":"2025-02-05T13:44:48Z","snapshot_observed_at":"2026-08-10T09:10:57.704493Z","submitted_at":"2024-06-24T11:16:26Z","title":"Token-based Decision Criteria Are Suboptimal in In-context Learning","version":3},"cited_work":{"arxiv_id":"2406.16535","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16535","snapshot_observed_at":"2026-08-10T14:06:15.709976Z","title":"Token-based Decision Criteria Are Suboptimal in In-context Learning","venue":"cs.CL","work_id":"153a2169-0f59-44ea-a25d-13f9a1970bc4","year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.182559Z"},"links":{"cited_paper":"/paper/2406.16535","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:cd0f67efd1a3326d60887900ebbf40d149f25eaa1e12e984b265cfe04fb70af6","observation_id":"3eb9a160-6da1-4186-926b-2e9f23a0d5c7","resolution":{"observed_at":"2026-08-10T14:06:15.715390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04468","last_updated":"2025-02-20T12:58:28Z","snapshot_observed_at":"2026-08-09T05:56:21.906767Z","submitted_at":"2024-10-06T12:50:15Z","title":"Revisiting In-context Learning Inference Circuit in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04468","snapshot_observed_at":"2026-08-10T14:06:14.186384Z","title":"Revisiting in-context learning inference circuit in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.186384Z"},"links":{"cited_paper":"/paper/2410.04468","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:ac684ff367ac44ab42efe16a4fcb1a840a86e2e6247b893af233be130ae11467","observation_id":"b295643e-9549-43e8-ba15-78b8a3383071","resolution":{"observed_at":"2026-08-10T14:06:14.186384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11639","last_updated":"2024-05-28T05:15:53Z","snapshot_observed_at":"2026-08-03T13:29:31.514854Z","submitted_at":"2024-02-18T16:37:32Z","title":"In-Context Learning with Transformers: Softmax Attention Adapts to Function Lipschitzness","version":2},"cited_work":{"arxiv_id":"2402.11639","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11639","snapshot_observed_at":"2026-08-10T14:06:15.663318Z","title":"In-Context Learning with Transformers: Softmax Attention Adapts to Function Lipschitzness","venue":"cs.LG","work_id":"d9d891bc-4378-47a8-851f-23be25bc4e2b","year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.191527Z"},"links":{"cited_paper":"/paper/2402.11639","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:4c1763bf20050b2493ac28ad651160c62373695b5b0dd03a1183066ca46525c8","observation_id":"58aa4e02-041a-49f3-ba43-89b7327f2ce3","resolution":{"observed_at":"2026-08-10T14:06:15.668862Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.196372Z","title":"The pascal recognising textual entailment challenge","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.196372Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:3a39059ba34a5efc60fb282e078e226e926f41ca09bfc709567b648dfbd2d5bf","observation_id":"0c7e0875-cdb7-4c4f-a702-bc4ecae5bf8f","resolution":{"observed_at":"2026-08-10T14:06:14.196372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10559","last_updated":"2023-05-15T11:45:12Z","snapshot_observed_at":"2026-08-09T08:03:27.441735Z","submitted_at":"2022-12-20T18:58:48Z","title":"Why Can GPT Learn In-Context? Language Models Implicitly Perform Gradient Descent as Meta-Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10559","snapshot_observed_at":"2026-08-10T14:06:14.202062Z","title":"Why can gpt learn in-context? language models implicitly perform gradient descent as meta-optimizers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.202062Z"},"links":{"cited_paper":"/paper/2212.10559","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:7c3aeb1a80977b3cc2391f2a5fe658ed0416c396c9eb6a70b8b0d19cdf37fe7c","observation_id":"92e23f1f-f03e-4a07-b763-62c7c1fe6948","resolution":{"observed_at":"2026-08-10T14:06:14.202062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.206895Z","title":"Hate Speech Dataset from a White Supremacy Forum","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.206895Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:b9652b024501131a1204f26d1cf43352baccfa468c19049cd9cc03240ef607cb","observation_id":"0512fcc3-219e-4721-93c6-586b6cda27c7","resolution":{"observed_at":"2026-08-10T14:06:14.206895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.210842Z","title":"The commitmentbank: Investigating projection in naturally occurring discourse","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.210842Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:f4d8816b5d14398c668b5381cd633b022d2c396aad4ec0b65d4df4cbd4ae82b4","observation_id":"b36690b4-bc0c-4e72-ba5a-8c3604df52c3","resolution":{"observed_at":"2026-08-10T14:06:14.210842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.215828Z","title":"Automatically constructing a corpus of sentential paraphrases","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.215828Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:39a279c15a1cc4294e8145c30cf527c5b0568c760e5c5431789c21d1c283119a","observation_id":"e597de8c-9786-46e4-a480-c0e373fbc441","resolution":{"observed_at":"2026-08-10T14:06:14.215828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-10T14:06:14.224501Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.224501Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:b2e383612267d52fa3726629ff28b823f517c1dde9234b37d7caebc79f2cb498","observation_id":"5e8f4222-34b7-4bd6-abb3-b009023d2e35","resolution":{"observed_at":"2026-08-10T14:06:14.224501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19148","last_updated":"2023-08-04T15:43:19Z","snapshot_observed_at":"2026-07-06T15:35:30.017377Z","submitted_at":"2023-05-28T15:37:39Z","title":"Mitigating Label Biases for In-context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19148","snapshot_observed_at":"2026-08-10T14:06:14.228730Z","title":"Mitigating label biases for in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.228730Z"},"links":{"cited_paper":"/paper/2305.19148","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:a62403459492ea9b2f1d5f7cad86d0b91ffbc2a9405f14d61af179da1a5e7cea","observation_id":"3c4c1784-12e4-495b-bd5c-aa75c6d69e97","resolution":{"observed_at":"2026-08-10T14:06:14.228730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.233647Z","title":"The third pascal recognizing textual entailment challenge","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.233647Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:581fc0e767f1990deb92fc6633b5d6eac6e1071d3bba90811da19efe05bd8564","observation_id":"11eb71b4-373a-43c9-8ec7-03b0d1ce3361","resolution":{"observed_at":"2026-08-10T14:06:14.233647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04037","last_updated":"2024-09-12T19:54:37Z","snapshot_observed_at":"2026-08-07T11:18:39.827875Z","submitted_at":"2022-12-08T02:21:47Z","title":"Demystifying Prompts in Language Models via Perplexity Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04037","snapshot_observed_at":"2026-08-10T14:06:14.237750Z","title":"Demystifying prompts in language models via perplexity estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.237750Z"},"links":{"cited_paper":"/paper/2212.04037","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:4c40cbb168c7fc4739524b04a704cc8c6fc4edaae5108c02ce8bd87b90e837bf","observation_id":"48e7faa4-e8ab-46f8-84b7-c60bc95449bf","resolution":{"observed_at":"2026-08-10T14:06:14.237750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T14:06:14.243244Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.243244Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:8716fbdfc61f84d506629d27241c3a6eaaffe06459d4a379146640dc079afdb9","observation_id":"5655f594-ac46-4e68-b331-6e8121107edf","resolution":{"observed_at":"2026-08-10T14:06:14.243244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09137","last_updated":"2023-05-16T03:38:06Z","snapshot_observed_at":"2026-08-08T10:17:50.560827Z","submitted_at":"2023-05-16T03:38:06Z","title":"Pre-Training to Learn in Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09137","snapshot_observed_at":"2026-08-10T14:06:14.249076Z","title":"Pre-training to learn in context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.249076Z"},"links":{"cited_paper":"/paper/2305.09137","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:87a1eebb2884133ccf46978bf10226aef8a68223039f3b1eccb87671c63fdb37","observation_id":"32b639c0-ef09-4624-ac1a-3db04e8493df","resolution":{"observed_at":"2026-08-10T14:06:14.249076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.04599","last_updated":"2017-08-03T13:29:46Z","snapshot_observed_at":"2026-08-09T16:28:11.835630Z","submitted_at":"2017-06-14T17:33:50Z","title":"On Calibration of Modern Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.04599","snapshot_observed_at":"2026-08-10T14:06:14.255773Z","title":"On calibration of modern neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.255773Z"},"links":{"cited_paper":"/paper/1706.04599","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:ff5f9ecd141eb9983a6c06e09dac646d1d2b748df196d6a5bcdd428ddbeb6a9a","observation_id":"10ef09ef-c9e2-4177-909d-1eab34d4c888","resolution":{"observed_at":"2026-08-10T14:06:14.255773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"paper/1363263","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:15.504956Z","title":"The second pascal recognising textual entailment challenge","venue":null,"work_id":"44527619-c44a-480c-bdc7-d19e50f875fd","year":2006},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.261756Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:8a3bb8ddc17da8f18a8981a5cb4828d202bd01573dbefb159178371a0536172e","observation_id":"f43655c5-164b-4c67-9ef6-a39da4df078a","resolution":{"observed_at":"2026-08-10T14:06:15.510932Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15091","last_updated":"2023-06-26T22:14:04Z","snapshot_observed_at":"2026-07-06T15:47:03.002949Z","submitted_at":"2023-06-26T22:14:04Z","title":"Understanding In-Context Learning via Supportive Pretraining Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15091","snapshot_observed_at":"2026-08-10T14:06:14.265880Z","title":"Understanding in-context learning via supportive pretraining data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.265880Z"},"links":{"cited_paper":"/paper/2306.15091","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:0d6d0c75ee34dcb612cd42e77c1fb689d8fb81ded57fda6c36d211af6eb4a120","observation_id":"df7edbf3-db27-47ec-8407-0cc83dae2bc8","resolution":{"observed_at":"2026-08-10T14:06:14.265880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10183","last_updated":"2022-10-05T01:33:07Z","snapshot_observed_at":"2026-08-11T07:00:49.912607Z","submitted_at":"2022-05-20T13:50:07Z","title":"Prototypical Calibration for Few-shot Learning of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10183","snapshot_observed_at":"2026-08-10T14:06:14.270792Z","title":"Prototypical calibration for few-shot learning of language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.270792Z"},"links":{"cited_paper":"/paper/2205.10183","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:a1c8d0a822192c9f0816a59ab2a08f0f02770bd9a6821354414003399b61c805","observation_id":"7be6977d-efd1-4f41-9c64-b2d2a092a38b","resolution":{"observed_at":"2026-08-10T14:06:14.270792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06713","last_updated":"2022-12-13T16:31:21Z","snapshot_observed_at":"2026-08-10T18:50:20.312015Z","submitted_at":"2022-12-13T16:31:21Z","title":"Structured Prompting: Scaling In-Context Learning to 1,000 Examples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06713","snapshot_observed_at":"2026-08-10T14:06:14.276299Z","title":"Structured prompting: Scaling in-context learning to 1,000 examples","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.276299Z"},"links":{"cited_paper":"/paper/2212.06713","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:5ffa5a33b43056a1719656a12350dbe942cdc1441dfeb5160c7c96960f97608e","observation_id":"89c047ea-ee44-4258-9fbb-3c0a34c9ffe4","resolution":{"observed_at":"2026-08-10T14:06:14.276299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.283277Z","title":"Toward semantics-based answer pinpointing","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.283277Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:df7f769cb34ab424c9a18cf30e2fad506ef205f73b7a2d2e5ff84720d82e50ee","observation_id":"cb7eef11-f680-4b00-b39b-2b83b8ec0b75","resolution":{"observed_at":"2026-08-10T14:06:14.283277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-08-10T14:22:27.023542Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-08-10T14:06:14.288144Z","title":"In-context convergence of transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.288144Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:d9e0c6abd4e07c527d062b54d8624afc262ed86ed1201b4477aeea5e21bda5fa","observation_id":"bdc2fbf6-6ec3-4a44-9786-cb16562992c8","resolution":{"observed_at":"2026-08-10T14:06:14.288144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.12017","last_updated":"2023-01-30T05:25:59Z","snapshot_observed_at":"2026-08-02T23:44:31.455796Z","submitted_at":"2022-12-22T19:56:09Z","title":"OPT-IML: Scaling Language Model Instruction Meta Learning through the Lens of Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.12017","snapshot_observed_at":"2026-08-10T14:06:14.292809Z","title":"Opt-iml: Scaling language model instruction meta learning through the lens of generalization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.292809Z"},"links":{"cited_paper":"/paper/2212.12017","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:ec68ce17a1786bb132fa106515069bb6d60d0560fddfa3d66445dcd3b09e766c","observation_id":"37631f8a-c931-4bfa-b9e7-87e33c90001d","resolution":{"observed_at":"2026-08-10T14:06:14.292809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15530","last_updated":"2024-01-28T00:36:44Z","snapshot_observed_at":"2026-08-10T19:14:19.609384Z","submitted_at":"2024-01-28T00:36:44Z","title":"An Information-Theoretic Analysis of In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15530","snapshot_observed_at":"2026-08-10T14:06:14.302132Z","title":"An information-theoretic analysis of in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.302132Z"},"links":{"cited_paper":"/paper/2401.15530","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:8e7f35af07e9370fc1c0e6ee3243aa777124a9d22e6f0034a711bb4d5155617c","observation_id":"8ba7df96-667e-43a1-8de2-d04ead9c704d","resolution":{"observed_at":"2026-08-10T14:06:14.302132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.307973Z","title":"Generative calibration for in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.307973Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:53d31d9ece5f02377a2c57c94882b08519c058e0c78cc25732abe46d0880f9e4","observation_id":"c849454d-7add-4291-8969-b2cbb7aa06c1","resolution":{"observed_at":"2026-08-10T14:06:14.307973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-10T14:06:14.311973Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.311973Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:8acbda25051b98ac5ddb7b398bec7dabed14eec6411ce2a1371ec761217de05c","observation_id":"f62c083d-2ede-4106-9840-6fda99fa0347","resolution":{"observed_at":"2026-08-10T14:06:14.311973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12375","last_updated":"2024-03-13T15:00:20Z","snapshot_observed_at":"2026-08-10T10:41:44.155126Z","submitted_at":"2023-07-23T16:54:41Z","title":"In-Context Learning Learns Label Relationships but Is Not Conventional Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12375","snapshot_observed_at":"2026-08-10T14:06:14.315650Z","title":"In-context learning learns label relationships but is not conventional learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.315650Z"},"links":{"cited_paper":"/paper/2307.12375","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:7a24d2be9809a554309927a036df212468b388b2b2702caadec5079031462be5","observation_id":"d3a90b1c-c4a2-4732-a89e-3fd7894e8b59","resolution":{"observed_at":"2026-08-10T14:06:14.315650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.320538Z","title":"The winograd schema challenge","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.320538Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:735935a119a5f9243e11fce5e7b983df16204b98315533db46cec6542b52262e","observation_id":"e67738a3-1fbb-42bb-bf82-c6a5fbbf8da5","resolution":{"observed_at":"2026-08-10T14:06:14.320538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04216","last_updated":"2024-08-05T15:08:02Z","snapshot_observed_at":"2026-08-09T19:47:16.567230Z","submitted_at":"2024-06-06T16:15:34Z","title":"What Do Language Models Learn in Context? The Structured Task Hypothesis","version":3},"cited_work":{"arxiv_id":"2406.04216","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04216","snapshot_observed_at":"2026-08-10T14:06:15.280184Z","title":"What Do Language Models Learn in Context? The Structured Task Hypothesis","venue":"cs.CL","work_id":"6eeeee1a-7e7f-4d13-85e3-8054589037e9","year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.324143Z"},"links":{"cited_paper":"/paper/2406.04216","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:a4f94affbbd1115084016a426f8fe651a33c0dc0f254cdaaa948a3b2b79e7c24","observation_id":"7ed2f0ad-1ecf-445d-8078-2248796565cb","resolution":{"observed_at":"2026-08-10T14:06:15.286166Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13539","last_updated":"2023-10-09T02:39:04Z","snapshot_observed_at":"2026-08-10T11:50:44.376019Z","submitted_at":"2023-02-27T06:32:45Z","title":"Finding Support Examples for In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13539","snapshot_observed_at":"2026-08-10T14:06:14.332242Z","title":"Finding support examples for in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.332242Z"},"links":{"cited_paper":"/paper/2302.13539","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:99815d73ed695506280362bf06d23feb3567e1381b61ee2a3d06c2ba22dcc00e","observation_id":"f96e78fd-6a2a-4b9b-9817-2dd2d4752a4f","resolution":{"observed_at":"2026-08-10T14:06:14.332242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04320","last_updated":"2023-05-16T05:59:25Z","snapshot_observed_at":"2026-08-10T12:59:14.021514Z","submitted_at":"2023-05-07T16:07:11Z","title":"Unified Demonstration Retriever for In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04320","snapshot_observed_at":"2026-08-10T14:06:14.337322Z","title":"Unified demonstration retriever for in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.337322Z"},"links":{"cited_paper":"/paper/2305.04320","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:fd6b5b063410a9c33a18f6db4f8de865bc5e850ac5ba2b279960d32c24d723b7","observation_id":"1b7846d9-ab16-4027-ac97-23b48e4faefa","resolution":{"observed_at":"2026-08-10T14:06:14.337322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.341229Z","title":"Learning question classifiers","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.341229Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:687ed0b80ad6ca215aeab20417ad3d720d371fec06caea8908144e6344075b25","observation_id":"e6a098c8-619e-43b0-b7a1-65d3f444c8a3","resolution":{"observed_at":"2026-08-10T14:06:14.341229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.161872Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration","venue":null,"work_id":"37ed3305-f5cb-4f6e-b6ac-276bbdf1de50","year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.345560Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:3cc25959322d1cc9b8f98747c354a195790a6231ec6f72820a4df0c8ecdc6306","observation_id":"767c65ca-08b5-4756-90bf-91b7d51127b6","resolution":{"observed_at":"2026-08-10T14:06:16.167066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.145125Z","title":null,"venue":null,"work_id":"b82a63d9-a601-4dff-afb4-4af68c7c7063","year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.352028Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:6cc037101b9dfda59e611d9173fc6d96b403639538bbec8785bbce47badffa4c","observation_id":"45b76046-d0df-408d-83b5-d688d2d34928","resolution":{"observed_at":"2026-08-10T14:06:16.150661Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10738","last_updated":"2024-06-16T13:26:10Z","snapshot_observed_at":"2026-07-06T17:31:13.010759Z","submitted_at":"2024-02-16T14:55:33Z","title":"Let's Learn Step by Step: Enhancing In-Context Learning Ability with Curriculum Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10738","snapshot_observed_at":"2026-08-10T14:06:14.357145Z","title":"Let's learn step by step: Enhancing in-context learning ability with curriculum learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.357145Z"},"links":{"cited_paper":"/paper/2402.10738","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:19a95b2044abedeb2658c4bcc3fa1d48007a1e02d9ddfe55fda270f6ffc9b3c4","observation_id":"f11bc8c6-f2a1-4437-8d47-68f4a2c63800","resolution":{"observed_at":"2026-08-10T14:06:14.357145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08786","last_updated":"2022-03-03T12:10:58Z","snapshot_observed_at":"2026-07-06T11:01:05.577957Z","submitted_at":"2021-04-18T09:29:16Z","title":"Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08786","snapshot_observed_at":"2026-08-10T14:06:14.365894Z","title":"Fantastically ordered prompts and where to find them: Overcoming few-shot prompt order sensitivity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.365894Z"},"links":{"cited_paper":"/paper/2104.08786","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:4df2c16976ca7b1a0cf06b0bf8645abbe0ad30f58bc6b9f279e419019c76f68e","observation_id":"4466abd0-8e18-4022-b9f4-262250e9da78","resolution":{"observed_at":"2026-08-10T14:06:14.365894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1307.5336","last_updated":"2013-07-23T19:56:38Z","snapshot_observed_at":"2026-08-06T05:11:58.467928Z","submitted_at":"2013-07-19T20:49:06Z","title":"Good Debt or Bad Debt: Detecting Semantic Orientations in Economic Texts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1307.5336","snapshot_observed_at":"2026-08-10T14:06:14.370846Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.370846Z"},"links":{"cited_paper":"/paper/1307.5336","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:989f9ae9aab2abebb1c12f4160f30feaa9c4b34e1506557f250db434f92c45ae","observation_id":"003064e8-86ab-4c29-8e87-104a3aa8150b","resolution":{"observed_at":"2026-08-10T14:06:14.370846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20046","last_updated":"2023-10-30T22:03:55Z","snapshot_observed_at":"2026-07-06T16:40:51.343918Z","submitted_at":"2023-10-30T22:03:55Z","title":"Which Examples to Annotate for In-Context Learning? Towards Effective and Efficient Selection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20046","snapshot_observed_at":"2026-08-10T14:06:14.375398Z","title":"Which examples to annotate for in-context learning? towards effective and efficient selection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.375398Z"},"links":{"cited_paper":"/paper/2310.20046","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:f046c10c4f8ae0994a8b7e2fb2d559858fd45450e49ba1c036c05cc7dfa9b255","observation_id":"152d6fac-ae5a-4ab4-ba90-700f4ab53f05","resolution":{"observed_at":"2026-08-10T14:06:14.375398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.04106","last_updated":"2022-03-15T06:53:43Z","snapshot_observed_at":"2026-07-06T11:36:47.756091Z","submitted_at":"2021-08-09T15:06:26Z","title":"Noisy Channel Language Model Prompting for Few-Shot Text Classification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.04106","snapshot_observed_at":"2026-08-10T14:06:14.380832Z","title":"Noisy channel language model prompting for few-shot text classification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.380832Z"},"links":{"cited_paper":"/paper/2108.04106","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:4d1b117ba1ce2e705c25cc401dda4514d61762a8353f2e8f786d07f5d023e216","observation_id":"b80e0d33-5e31-4ebd-9274-dfe386dd10cd","resolution":{"observed_at":"2026-08-10T14:06:14.380832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.127092Z","title":"Metaicl: Learning to learn in context","venue":null,"work_id":"5f41b3ca-53ac-4989-ae28-27a0e4660ffd","year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.385845Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:904036b70d921137a8d77527bc69ea56a33b7a99739bbe075af06c16bf5864bc","observation_id":"0f0819d7-949a-40a2-a4bd-bd19bc4ea141","resolution":{"observed_at":"2026-08-10T14:06:16.132163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.109899Z","title":null,"venue":null,"work_id":"21cef738-e837-4928-8caa-8422e932e9c8","year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.392148Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:8c97b2d98648011f093eaff2c685d2d0376d7ee86c696aae9d9b3085f7302672","observation_id":"b0e07819-2020-4343-971f-7f000ceaa47d","resolution":{"observed_at":"2026-08-10T14:06:16.115192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.396930Z","title":"S em E val-2018 task 1: Affect in tweets","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.396930Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:c00cb05be71fcd2038c52cad66c4e7521f081bc359c7f140a1661efb066d845e","observation_id":"50ca163e-df99-4f78-aeae-d0e4b13e8ba3","resolution":{"observed_at":"2026-08-10T14:06:14.396930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.090250Z","title":"Obtaining well calibrated probabilities using bayesian binning","venue":null,"work_id":"17668560-7e1e-47e3-840f-5b0b45345528","year":2015},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.402009Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:01cd6670801e0b575b58d114573523cb88a573ee7035a97500116586da3c5ce8","observation_id":"b9f937f4-f9ac-45e3-b972-7375118e0c70","resolution":{"observed_at":"2026-08-10T14:06:16.096135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-10T14:06:14.406607Z","title":"In-context learning and induction heads","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.406607Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:078520fe0a825cd1b562b3c2c293189ce6eb9545052884ef22c4707f52b507d8","observation_id":"ae197314-c3c0-4f8e-b9f5-1d5343724c93","resolution":{"observed_at":"2026-08-10T14:06:14.406607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09731","last_updated":"2023-05-16T18:05:19Z","snapshot_observed_at":"2026-08-10T20:03:37.585348Z","submitted_at":"2023-05-16T18:05:19Z","title":"What In-Context Learning \"Learns\" In-Context: Disentangling Task Recognition and Task Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09731","snapshot_observed_at":"2026-08-10T14:06:14.410213Z","title":"What in-context learning\" learns\" in-context: Disentangling task recognition and task learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.410213Z"},"links":{"cited_paper":"/paper/2305.09731","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:2e4fc8519eb7b1a214a2e3376f6506848ad355399d48cf49f3e0b91709b0a188","observation_id":"53bf0400-d0d6-413e-9600-afd48269f793","resolution":{"observed_at":"2026-08-10T14:06:14.410213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"cs/0506075","last_updated":"2005-06-17T20:10:43Z","snapshot_observed_at":"2026-08-05T01:41:21.910243Z","submitted_at":"2005-06-17T20:10:43Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"cs/0506075","snapshot_observed_at":"2026-08-10T14:06:14.413670Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.413670Z"},"links":{"cited_paper":"/paper/cs/0506075","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:938baa6636512ae59d73bea9f917fad68334217ef37298bc9a86a5a3dfd4ccb3","observation_id":"2d87c6b4-8e4e-45b1-bbf6-7fe3c8536be6","resolution":{"observed_at":"2026-08-10T14:06:14.413670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.070643Z","title":"Mauve: Measuring the gap between neural text and human text using divergence frontiers","venue":null,"work_id":"f8150828-6173-4645-8a9f-9a8b5fbf1501","year":2021},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.418760Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:738e344134a4f5e4dda697d8c8ea944bdb6ef80e8e85829bb2cce3c2219bbadf","observation_id":"48332f64-e7d2-4d73-a973-aa1607b6259b","resolution":{"observed_at":"2026-08-10T14:06:16.077762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09881","last_updated":"2024-12-30T04:27:05Z","snapshot_observed_at":"2026-08-10T11:49:13.645760Z","submitted_at":"2023-10-15T16:40:19Z","title":"In-Context Learning with Iterative Demonstration Selection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09881","snapshot_observed_at":"2026-08-10T14:06:14.423005Z","title":"In-context learning with iterative demonstration selection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.423005Z"},"links":{"cited_paper":"/paper/2310.09881","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:db13a06f64a819a8129aeb6fc9b376efd4d25b07b24bbd2a4a65108c3c506795","observation_id":"40095b46-f517-405a-8a52-84059baee27f","resolution":{"observed_at":"2026-08-10T14:06:14.423005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.053423Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"b0b11315-e2b4-4b39-8a4a-0069c50098b0","year":2019},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.427267Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:eda341c7e4cce3a5f00d1b657e2778ddf4ac1a21beeb8cd1445ebbef1b6938c8","observation_id":"0def45d3-323b-4d9f-b67b-cd118e50fbec","resolution":{"observed_at":"2026-08-10T14:06:16.057860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.15004","last_updated":"2023-05-22T15:56:25Z","snapshot_observed_at":"2026-08-10T17:31:31.358063Z","submitted_at":"2023-04-28T17:52:11Z","title":"Are Emergent Abilities of Large Language Models a Mirage?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.15004","snapshot_observed_at":"2026-08-10T14:06:14.433036Z","title":"Are emergent abilities of large language models a mirage? Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.433036Z"},"links":{"cited_paper":"/paper/2304.15004","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:c6b34549991196984ccd26dc1b32a68be252333d279774d86521b0941de62b14","observation_id":"12a111ed-0278-4acb-becb-575ea0531f6a","resolution":{"observed_at":"2026-08-10T14:06:14.433036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.029714Z","title":"Smith, Luke Zettlemoyer, Wen tau Yih, and Mike Lewis","venue":null,"work_id":"403b4e82-3124-4a31-8d84-e2e9f59fb6a3","year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.437317Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:8706e82b821729372efd12e4190cf633a6d24165df873ca1814cea2f33787ed5","observation_id":"df714cd1-7ec7-4e7b-ba7b-12ffa188da0b","resolution":{"observed_at":"2026-08-10T14:06:16.034971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19592","last_updated":"2024-05-30T01:11:35Z","snapshot_observed_at":"2026-07-06T18:22:22.643181Z","submitted_at":"2024-05-30T01:11:35Z","title":"Why Larger Language Models Do In-context Learning Differently?","version":1},"cited_work":{"arxiv_id":"2405.19592","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.19592","snapshot_observed_at":"2026-08-10T14:06:15.055315Z","title":"Why Larger Language Models Do In-context Learning Differently?","venue":"cs.LG","work_id":"19a29a12-ec9f-4a89-831e-c0d8646ee877","year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.443286Z"},"links":{"cited_paper":"/paper/2405.19592","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:1c64ba229bb4401a94f20c99cfbc531eff87ea8f0b1496eac23ce7b19f0db8bc","observation_id":"15edcae4-55ce-4f59-8a4a-00fc97069605","resolution":{"observed_at":"2026-08-10T14:06:15.067163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.448202Z","title":"Manning, Andrew Ng, and Christopher Potts","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.448202Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:6173796b6b86878a131492a4648408020c6bd28cf33d43df734fce8626155595","observation_id":"9b0e7cc3-5232-4548-8109-8c1098b8e7d0","resolution":{"observed_at":"2026-08-10T14:06:14.448202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-10T14:06:14.453812Z","title":"Beyond the imitation game: Quantifying and extrapolating the capabilities of language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.453812Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:44767854892bb3c9300a311113d07f3c65f630ef304ce904f916cc69acf319a0","observation_id":"7a1ba241-f3c5-4ac1-a87f-6b0e56aca373","resolution":{"observed_at":"2026-08-10T14:06:14.453812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:16.004464Z","title":"Smith, and Tao Yu","venue":null,"work_id":"cebd2387-7c73-4e4b-93d4-2e8f889646f6","year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.461149Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:8269370554144f23d5078edf3cb9f0556e954d32904b1bb7d89e235ddfa88ad8","observation_id":"2c62c872-aa62-416c-b172-ac067c79b8cd","resolution":{"observed_at":"2026-08-10T14:06:16.008410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-10T14:06:14.467857Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.467857Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:07be2eecea04e8f6b76c5dd30c15156125dc6771b51b84d70bae51a65fc01a38","observation_id":"6f12650d-6bb5-41b9-b0a4-f2d72c38eb7e","resolution":{"observed_at":"2026-08-10T14:06:14.467857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:15.989206Z","title":"Taguchi methods: orthogonal arrays and linear graphs; tools for quality engineering","venue":null,"work_id":"d72ace6b-8ce6-4f07-b4b9-f24828ec5fc6","year":1987},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.472411Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:8a2d422175f025879b86b5ff6a87b823d344211ffbd02fcd58129552e97538cc","observation_id":"73238bcb-0a08-4725-bb43-d1716937199d","resolution":{"observed_at":"2026-08-10T14:06:15.994134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T14:06:14.477102Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.477102Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:807817e58c65685a3cad4f92e9e3aee2d1fe1c8c1f2c19686db7ed618503f000","observation_id":"b0d69a35-2af2-41a5-8e03-2e5e4345d41f","resolution":{"observed_at":"2026-08-10T14:06:14.477102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11750","last_updated":"2024-06-17T18:34:54Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-19T00:39:31Z","title":"In-Context Learning Demonstration Selection via Influence Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11750","snapshot_observed_at":"2026-08-10T14:06:14.481089Z","title":"In-context learning demonstration selection via influence analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.481089Z"},"links":{"cited_paper":"/paper/2402.11750","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:7d635570c3576e3ea2b0fa25a98de3e32dffe9b6e86a6baf711e98af2b2e31eb","observation_id":"b953b9e5-1999-41c9-8794-6f96b7f90ac6","resolution":{"observed_at":"2026-08-10T14:06:14.481089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06766","last_updated":"2024-06-06T19:01:37Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-12T18:58:26Z","title":"Mind Your Format: Towards Consistent Evaluation of In-Context Learning Improvements","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06766","snapshot_observed_at":"2026-08-10T14:06:14.485132Z","title":"Mind your format: Towards consistent evaluation of in-context learning improvements","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.485132Z"},"links":{"cited_paper":"/paper/2401.06766","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:18f877600d5c3494eb585304a2e95e956478ff0a888d21ab1a25a9e87d99c91c","observation_id":"259a727c-0287-458d-b5ec-11adb395f183","resolution":{"observed_at":"2026-08-10T14:06:14.485132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:15.969596Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":"9d66c8d1-375e-4c97-a63b-d540ab495f82","year":2019},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.488769Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:fe240a1994ccc2cf668a233077bb6597531a6986696d24ad71809f09349f2e21","observation_id":"01fc1b68-412c-4409-af6a-5e9c006d1cf6","resolution":{"observed_at":"2026-08-10T14:06:15.975535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:15.951133Z","title":"Gpt-j-6b: A 6 billion parameter autoregressive language model, 2021","venue":null,"work_id":"278a0466-bf8c-442c-a1b1-0fb91118a473","year":2021},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.493107Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:88bf644f1f968a46515c1d5dfbd45b51d6c8fa4730ab9076d5d30adfb5028d9a","observation_id":"f79291e1-da59-47f4-a7d6-fa902a044497","resolution":{"observed_at":"2026-08-10T14:06:15.956798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14160","last_updated":"2023-12-19T15:13:52Z","snapshot_observed_at":"2026-08-04T17:03:48.643939Z","submitted_at":"2023-05-23T15:26:20Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14160","snapshot_observed_at":"2026-08-10T14:06:14.497128Z","title":"Label words are anchors: An information flow perspective for understanding in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.497128Z"},"links":{"cited_paper":"/paper/2305.14160","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:adbeb835407200a822fad7ad599e26bd3ce4181b9c4851ccd046f59658c246e7","observation_id":"82b18dec-b3da-4bec-8f00-16a65455e80c","resolution":{"observed_at":"2026-08-10T14:06:14.497128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:15.933646Z","title":null,"venue":null,"work_id":"1fe12e96-9931-43c7-aba6-8b63a54625a6","year":2012},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.502007Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:2a1cb4094ea75580a45aeb3e68d97a330dafadb1c3a24fe0c2a3ce44befd58f4","observation_id":"99919121-0f4b-4430-8812-5da0ac3b3c1b","resolution":{"observed_at":"2026-08-10T14:06:15.937818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.507093Z","title":"Dai, and Quoc V Le","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.507093Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:0aae943781eaba000728e4558c49da3c46f896bde38a5aad4ffda077c1e80100","observation_id":"ccab2046-ba74-4ec8-acd3-3c0c41e02ece","resolution":{"observed_at":"2026-08-10T14:06:14.507093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08298","last_updated":"2023-12-30T21:23:17Z","snapshot_observed_at":"2026-08-07T20:49:42.850082Z","submitted_at":"2023-05-15T01:59:58Z","title":"Symbol tuning improves in-context learning in language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08298","snapshot_observed_at":"2026-08-10T14:06:14.511941Z","title":"Symbol tuning improves in-context learning in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.511941Z"},"links":{"cited_paper":"/paper/2305.08298","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:63145a3492b014cf76e03ff4138662a8186da544b82273dcbab713fd097c4868","observation_id":"726afa35-c252-4416-8545-3765528f6b30","resolution":{"observed_at":"2026-08-10T14:06:14.511941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-08-10T13:53:36.347431Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-10T14:06:14.517258Z","title":"Larger language models do in-context learning differently","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.517258Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:f8cf27a4fbe3049c5a7e666bc9658fbba5a525ef30f4b41d27e87fae628d4eea","observation_id":"bbfc8a5e-5f60-4dcd-ae78-5c82d2561483","resolution":{"observed_at":"2026-08-10T14:06:14.517258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07895","last_updated":"2023-03-14T13:28:39Z","snapshot_observed_at":"2026-08-09T06:38:25.697286Z","submitted_at":"2023-03-14T13:28:39Z","title":"The Learnability of In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.07895","snapshot_observed_at":"2026-08-10T14:06:14.522157Z","title":"The learnability of in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.522157Z"},"links":{"cited_paper":"/paper/2303.07895","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:4e321ed9f014769784103f0245837d1dde01ff0e6f23dd381f8f16b945c03e22","observation_id":"b42a72c8-e9d6-44a9-9ca2-6cff612889cf","resolution":{"observed_at":"2026-08-10T14:06:14.522157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10375","last_updated":"2023-05-03T14:43:50Z","snapshot_observed_at":"2026-07-06T14:33:03.656499Z","submitted_at":"2022-12-20T15:55:21Z","title":"Self-Adaptive In-Context Learning: An Information Compression Perspective for In-Context Example Selection and Ordering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10375","snapshot_observed_at":"2026-08-10T14:06:14.526159Z","title":"Self-adaptive in-context learning: An information compression perspective for in-context example selection and ordering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.526159Z"},"links":{"cited_paper":"/paper/2212.10375","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:dcf57adfefade616c2581a053ac817f18da5543fdc22c4f6f93e1dfe02d07844","observation_id":"45c787ea-450d-4349-98c5-e5b9d02d1873","resolution":{"observed_at":"2026-08-10T14:06:14.526159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.533084Z","title":"\\ k\\ NN prompting: Beyond-context learning with calibration-free nearest neighbor inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.533084Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:09a31303447ebcf23d9ae75c184fc1b6f5b03b183397f143de64d44b13211294","observation_id":"6a3d6025-6284-4251-84e9-610d676962d6","resolution":{"observed_at":"2026-08-10T14:06:14.533084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12685","last_updated":"2022-10-24T17:44:25Z","snapshot_observed_at":"2026-07-06T13:13:48.138379Z","submitted_at":"2022-05-25T11:45:14Z","title":"Ground-Truth Labels Matter: A Deeper Look into Input-Label Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12685","snapshot_observed_at":"2026-08-10T14:06:14.539926Z","title":"Ground-truth labels matter: A deeper look into input-label demonstrations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.539926Z"},"links":{"cited_paper":"/paper/2205.12685","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:13e693e5a6593cfff05c023019980fd55d45d2068c5bf31ac89767dd3d167719","observation_id":"4a8077c0-f130-4ea9-9fb4-fd2339037bad","resolution":{"observed_at":"2026-08-10T14:06:14.539926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-10T14:06:14.544551Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.544551Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:f050b8fd575c003a08d62b76c5e47a4af9e43366f933ed5bd627b20810f134fd","observation_id":"e6074dc3-faeb-40b4-82c5-5808ed5585f6","resolution":{"observed_at":"2026-08-10T14:06:14.544551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:15.896184Z","title":"Character-level convolutional networks for text classification","venue":null,"work_id":"80cab9ed-b965-4d22-834e-d8207213e6f0","year":2015},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.549004Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:a2fd2f6c06e668f37038e142f6a26774e0b2f6dcba933bfcafe8eb696464e47d","observation_id":"eda6c67b-9fba-4890-a742-b9ad9761c047","resolution":{"observed_at":"2026-08-10T14:06:15.906159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05515","last_updated":"2024-02-15T15:25:47Z","snapshot_observed_at":"2026-07-06T17:27:20.784234Z","submitted_at":"2024-02-08T09:48:02Z","title":"NoisyICL: A Little Noise in Model Parameters Calibrates In-context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05515","snapshot_observed_at":"2026-08-10T14:06:14.555581Z","title":"Noisyicl: A little noise in model parameters calibrates in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.555581Z"},"links":{"cited_paper":"/paper/2402.05515","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:70ca8cbc27683cc25b3ced8ece6a7f36aee11ce42f01a271e9c1e450b49489e5","observation_id":"2e1f7aa8-0018-4d3a-8ace-1c7ceff893cd","resolution":{"observed_at":"2026-08-10T14:06:14.555581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09690","last_updated":"2021-06-10T18:20:59Z","snapshot_observed_at":"2026-08-10T20:03:40.241346Z","submitted_at":"2021-02-19T00:23:59Z","title":"Calibrate Before Use: Improving Few-Shot Performance of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09690","snapshot_observed_at":"2026-08-10T14:06:14.562327Z","title":"Calibrate before use: Improving few-shot performance of language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.562327Z"},"links":{"cited_paper":"/paper/2102.09690","citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:fdd4965f7db8bc24e6c61eb6e1477953c5425128e6c923d33c4ce4801937f5cd","observation_id":"22e0aee5-c82d-4e50-a060-0a527e33de59","resolution":{"observed_at":"2026-08-10T14:06:14.562327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:15.879539Z","title":"Batch calibration: Rethinking calibration for in-context learning and prompt engineering","venue":null,"work_id":"f3911d92-7465-46e2-a5e3-97c02d4b0647","year":2024},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.572015Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:723a30e72fb1bdb2e7b3ddea90018595e9868b7424e36f7e7c487d34df8cbe60","observation_id":"3da3a998-32f8-46af-980c-f2c5c30d6126","resolution":{"observed_at":"2026-08-10T14:06:15.884959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.577120Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.577120Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:117ec403bde30861faeaf0340902c170c597d09eaf9bee713675eeb436aa0281","observation_id":"3276ce66-2b36-4a79-9fba-5d4f6f8c4256","resolution":{"observed_at":"2026-08-10T14:06:14.577120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.581526Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.581526Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:11fe0878c617d60248caf300589b33cf4ead81bbd07e13fcb6cecaeb541ee827","observation_id":"cfb25996-c285-4423-8431-c9a6ed5b0656","resolution":{"observed_at":"2026-08-10T14:06:14.581526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.586719Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.586719Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:73f106aea668862e7f826faf35251490b7f9db31d9f33fd2899f528547c58f1b","observation_id":"c741e329-9326-4c1a-90eb-c991066fdc58","resolution":{"observed_at":"2026-08-10T14:06:14.586719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:06:14.591107Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-10T14:06:14.591107Z"},"links":{"citing_paper":"/paper/2501.15708"},"observation_digest":"sha256:d253158bbca6e77a36c512b3fab3ba7041656064eb3b074ac1540828df47bbeb","observation_id":"1fa5b7c3-06df-4aec-8a9b-3cad255f5efa","resolution":{"observed_at":"2026-08-10T14:06:14.591107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.15708","last_updated":"2025-04-18T08:09:26Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T14:22:34.514445Z","submitted_at":"2025-01-27T00:05:12Z","title":"StaICC: Standardized Evaluation for Classification Task in In-context Learning"},"reference_resolution":{"displayed":91,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":71,"verified_exact":7,"verified_fuzzy":12},"total_outbound_references":91},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 91 of 91 outbound references and 0 inbound Pith citation observations for arXiv:2501.15708."}