{"as_of":"2026-08-14T09:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f621f3de26cb8ec8dfdcedc9ae2602fbe145dc260e637f174048b76a93201e2e","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T19:38:27.146182Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":47,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:02:43.191164Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":19,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-10T15:02:43.191164Z","title":"X., and Hasan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.17178","last_updated":"2025-05-27T07:58:46Z","snapshot_observed_at":"2026-08-13T06:12:48.981684Z","submitted_at":"2025-01-24T17:01:14Z","title":"Tuning LLM Judge Design Decisions for 1/1000 of the Cost","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T15:02:43.191164Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2501.17178"},"observation_digest":"sha256:db7db1c9a55ef5abd1a462a9d2e0d923b599a6c495dc99be4110cb603ccd6233","observation_id":"f62d0ab9-a5fa-44a5-94af-b064f3d14fb8","resolution":{"observed_at":"2026-08-10T15:02:43.191164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-09T16:20:57.704938Z","title":"X., and Hasan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01179","last_updated":"2025-05-29T14:57:31Z","snapshot_observed_at":"2026-08-14T07:03:31.616412Z","submitted_at":"2025-02-03T09:13:09Z","title":"Joint Localization and Activation Editing for Low-Resource Fine-Tuning","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T16:20:57.704938Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2502.01179"},"observation_digest":"sha256:3247559e33a15f2ad6f933a3a098835beabcf076914375078c5c774b80a158df","observation_id":"3cb50cfb-bd4f-4f22-bda6-79dc1131fb64","resolution":{"observed_at":"2026-08-09T16:20:57.704938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-08-12T20:41:24.869212Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:27da12d251e277163a7544b7aaa60e48ecde908b3917df06b65cdc0d24683430","observation_id":"b982bc44-7e8b-4abe-a956-ac258d239819","resolution":{"observed_at":"2026-05-12T05:42:58.542908Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2504.21850","last_updated":"2026-05-14T18:32:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T17:57:22Z","title":"Visual Compositional Tuning","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T17:39:09.890605Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2504.21850"},"observation_digest":"sha256:3dbc0ea461ee668c06ef93525625bdc30dac8a2b2653d8429940cf7339b05fe4","observation_id":"eaecaba5-8624-434a-8616-45e223fe0258","resolution":{"observed_at":"2026-05-22T17:41:53.123803Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-07T15:12:20.912641Z","title":"Does prompt formatting have any impact on llm performance? arXiv preprint arXiv:2411.10541, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.912641Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:6d8a677eea77bd90794b6e7c1209e7d5dc7872ea5e65cf30b25fd9be88beb71d","observation_id":"5cf0360d-fe30-4af0-801e-713682834ef7","resolution":{"observed_at":"2026-08-07T15:12:20.912641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-07T12:07:29.875050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00622","last_updated":"2025-06-03T08:31:06Z","snapshot_observed_at":"2026-08-13T16:14:41.386423Z","submitted_at":"2025-05-31T16:20:14Z","title":"Improving Dialogue State Tracking through Combinatorial Search for In-Context Examples","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:29.875050Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2506.00622"},"observation_digest":"sha256:e41a4c07e5c5f00add261d73e0fc4e0df309dbf960184374ffec0a7b59402dfb","observation_id":"d1e352eb-8516-4d5d-9585-c73cfe3220ab","resolution":{"observed_at":"2026-08-07T12:07:29.875050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-07T12:05:56.921126Z","title":"Does prompt formatting have any impact on llm performance?arXiv preprint arXiv:2411.10541, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-12T06:05:45.519570Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.921126Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:9e3599170c8464fd940dc06a8a0c1cead7c19bd1c7241f857647162067d07f2d","observation_id":"c2dbf4f5-0b16-4863-992b-3b745ee773c4","resolution":{"observed_at":"2026-08-07T12:05:56.921126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-07T05:23:10.935880Z","title":"X., and Hasan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08184","last_updated":"2025-07-31T16:45:51Z","snapshot_observed_at":"2026-08-14T01:57:51.684187Z","submitted_at":"2025-06-09T19:49:11Z","title":"Unable to Forget: Proactive Interference Reveals Working Memory Limits in LLMs Beyond Context Length","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:23:10.935880Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2506.08184"},"observation_digest":"sha256:c67691a90054b647df1bc5cbc2b03b94b91f9812451f8933f068536e02e32911","observation_id":"7151bf95-2b4d-4b0c-8b6b-7f3fa6f91683","resolution":{"observed_at":"2026-08-07T05:23:10.935880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-06T21:54:46.151962Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23133","last_updated":"2025-06-29T08:11:52Z","snapshot_observed_at":"2026-08-14T00:21:07.956444Z","submitted_at":"2025-06-29T08:11:52Z","title":"Format-Adapter: Improving Reasoning Capability of LLMs by Adapting Suitable Format","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T21:54:46.151962Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2506.23133"},"observation_digest":"sha256:6184d6841f1f06b0e4ba826a6ca1069e32836f2024bbc9a4a1b75e679c8af17e","observation_id":"80996026-b4eb-4356-a66e-21d97e62be9b","resolution":{"observed_at":"2026-08-06T21:54:46.151962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-06T21:10:04.524128Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00829","last_updated":"2025-07-01T15:01:18Z","snapshot_observed_at":"2026-08-08T03:47:45.535102Z","submitted_at":"2025-07-01T15:01:18Z","title":"On the Surprising Efficacy of LLMs for Penetration-Testing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:10:04.524128Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2507.00829"},"observation_digest":"sha256:ab2bb3e35f15e097b041b71d68109a849f15cda67eea0efdfb2856caf43ff1d6","observation_id":"9a2fb4a9-d0b9-401d-bd66-52ba8e377ad2","resolution":{"observed_at":"2026-08-06T21:10:04.524128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-06T16:26:35.088222Z","title":"Does prompt formatting have any impact on llm performance?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13577","last_updated":"2025-07-17T23:43:22Z","snapshot_observed_at":"2026-08-14T00:21:08.394758Z","submitted_at":"2025-07-17T23:43:22Z","title":"LLM-Based Community Surveys for Operational Decision Making in Interconnected Utility Infrastructures","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:35.088222Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2507.13577"},"observation_digest":"sha256:2b2811f4605518dee0e62ae5926c1eb0a8fdc6b7843842fa32cf1e09772336bf","observation_id":"5cb45521-7f67-4835-b458-ef56df398585","resolution":{"observed_at":"2026-08-06T16:26:35.088222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-06T14:53:04.452317Z","title":"Does prompt formatting have any impact on llm performance?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17512","last_updated":"2025-07-23T13:51:04Z","snapshot_observed_at":"2026-08-09T23:40:29.433863Z","submitted_at":"2025-07-23T13:51:04Z","title":"Can One Domain Help Others? A Data-Centric Study on Multi-Domain Reasoning via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:53:04.452317Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2507.17512"},"observation_digest":"sha256:f8c1116c623d8c22b8ac56ef9cdedbc927b29e57843ddecae10ce1f89cf10975","observation_id":"5e7aed1c-a2a7-43bd-b6f3-d7e3c7508252","resolution":{"observed_at":"2026-08-06T14:53:04.452317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-06T13:56:49.433560Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19951","last_updated":"2025-07-26T13:35:57Z","snapshot_observed_at":"2026-08-14T00:21:09.245207Z","submitted_at":"2025-07-26T13:35:57Z","title":"PDLogger: Automated Logging Framework for Practical Software Development","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:56:49.433560Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2507.19951"},"observation_digest":"sha256:008c8f7471c149de0939c4bc54dc8ce6a4c68fb7e3e84d3edca67267bb642151","observation_id":"3abf5ea6-9b20-49be-a756-7971851d4cd3","resolution":{"observed_at":"2026-08-06T13:56:49.433560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T18:53:49.140514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13948","last_updated":"2025-08-19T15:37:29Z","snapshot_observed_at":"2026-08-08T19:36:19.361408Z","submitted_at":"2025-08-19T15:37:29Z","title":"Prompt Orchestration Markup Language","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T18:53:49.140514Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2508.13948"},"observation_digest":"sha256:382df5a04051e19adbc021705d35c38e3489185fdaa57a9dd95ad832905cda11","observation_id":"edce00f9-5856-4c78-8176-a869ed7919fb","resolution":{"observed_at":"2026-08-05T18:53:49.140514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T14:23:36.867999Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21389","last_updated":"2025-08-29T08:05:00Z","snapshot_observed_at":"2026-08-13T03:10:57.103348Z","submitted_at":"2025-08-29T08:05:00Z","title":"AllSummedUp: un framework open-source pour comparer les metriques d'evaluation de resume","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T14:23:36.867999Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2508.21389"},"observation_digest":"sha256:f86b817f959d6e9a6b4079f623ba5fe7a260c27c29d56f4141e232b3100a5852","observation_id":"3c02faab-946d-4e47-ad8c-a081d3c7c8b1","resolution":{"observed_at":"2026-08-05T14:23:36.867999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T14:21:52.524764Z","title":"X.; Hasan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21452","last_updated":"2025-08-29T09:36:54Z","snapshot_observed_at":"2026-08-06T13:32:05.748419Z","submitted_at":"2025-08-29T09:36:54Z","title":"From Canonical to Complex: Benchmarking LLM Capabilities in Undergraduate Thermodynamics","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T14:21:52.524764Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2508.21452"},"observation_digest":"sha256:25625005944f190a8997911c324f6eb4f1ae22f8b145b7b621a0c6d708bac855","observation_id":"7e568103-5dd1-4c85-963f-234afb0830e0","resolution":{"observed_at":"2026-08-05T14:21:52.524764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-04T20:09:16.223582Z","title":"https: //arxiv.org/abs/2411.10541 20","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08803","last_updated":"2025-09-10T17:36:25Z","snapshot_observed_at":"2026-08-06T13:54:36.806572Z","submitted_at":"2025-09-10T17:36:25Z","title":"Scaling Truth: The Confidence Paradox in AI Fact-Checking","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:16.223582Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2509.08803"},"observation_digest":"sha256:4445eda01a7871d4c996e9c05360f0de08978f50a38e99b5bb17db11a4f23df6","observation_id":"6861b88c-3610-4746-9590-f1c52d8534ed","resolution":{"observed_at":"2026-08-04T20:09:16.223582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-04T12:12:57.512443Z","title":"Does prompt formatting have any impact on llm performance?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.03595","last_updated":"2026-07-10T05:48:25Z","snapshot_observed_at":"2026-08-10T16:27:22.396623Z","submitted_at":"2025-10-04T00:52:48Z","title":"Decoupling Task-Solving and Output Formatting in LLM Generation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T12:12:57.512443Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2510.03595"},"observation_digest":"sha256:58b2ff7852baa3a2d24ffef6d5cc1941f8468d577490e5dda7dcb0b15189ab8c","observation_id":"ee23a11b-da0a-4c66-aa04-737828cbb71e","resolution":{"observed_at":"2026-08-04T12:12:57.512443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-04T11:34:39.069488Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04391","last_updated":"2026-07-01T18:39:53Z","snapshot_observed_at":"2026-08-14T02:46:48.802959Z","submitted_at":"2025-10-05T23:01:10Z","title":"Psychological Imagination Networks Show Cross-Population Centrality and Clustering Alignment in Humans That Large Language Models Fail to Replicate","version":5},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-04T11:34:39.069488Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2510.04391"},"observation_digest":"sha256:4af270937e274b1cfd5e075c338ecb4d7fc421b27c7309396065e7449a51ca42","observation_id":"9fdb906e-a7f2-4b8d-8506-5886521ffa86","resolution":{"observed_at":"2026-08-04T11:34:39.069488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-04T07:01:32.180462Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.27489","last_updated":"2026-05-28T12:06:03Z","snapshot_observed_at":"2026-08-07T02:36:15.354783Z","submitted_at":"2025-10-31T14:07:42Z","title":"Auditing LLM Editorial Bias in News Media Exposure","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T07:01:32.180462Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2510.27489"},"observation_digest":"sha256:28d52d352d9e8f0271e2312a404f4bccb5baa01b1854cd597951aaa6cf9f01e7","observation_id":"176f5e06-66f8-4ca6-b949-b3cdb15ae1f0","resolution":{"observed_at":"2026-08-04T07:01:32.180462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2511.20284","last_updated":"2026-05-05T13:11:45Z","snapshot_observed_at":"2026-08-03T04:18:43.042605Z","submitted_at":"2025-11-25T13:11:23Z","title":"Can LLMs Make (Personalized) Access Control Decisions?","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T05:33:18.457421Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2511.20284"},"observation_digest":"sha256:0e081c3d593a5abf1e8be1f4b8c61eec7206c5772878f52ca11ec100cc5c55cb","observation_id":"b75902e3-0159-436b-ad22-24717125134d","resolution":{"observed_at":"2026-05-17T05:34:04.972248Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-04T07:16:37.050911Z","title":"URLhttps://arxiv","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10961","last_updated":"2026-05-24T03:46:01Z","snapshot_observed_at":"2026-08-14T06:45:49.302468Z","submitted_at":"2025-10-30T11:55:34Z","title":"AI as Equalizer or Amplifier? Task Complexity as the Moderating Factor for Human Expertise in Hybrid Intelligence Systems","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T07:16:37.050911Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2512.10961"},"observation_digest":"sha256:110fadc9806cb49a54f0d7dc25c3c4b54887f5b2a30c35e44f4d1293f6409db3","observation_id":"24d92e6f-8da0-4249-a68e-ee9886909f1f","resolution":{"observed_at":"2026-08-04T07:16:37.050911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2604.14930","last_updated":"2026-04-16T12:18:27Z","snapshot_observed_at":"2026-07-06T23:02:36.062162Z","submitted_at":"2026-04-16T12:18:27Z","title":"IE as Cache: Information Extraction Enhanced Agentic Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T10:49:50.177400Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2604.14930"},"observation_digest":"sha256:ef92d17b6da93342aaeb3ba84d743e460240bd924117cba919c7612d207775f5","observation_id":"ba86a030-70c9-4e5d-96aa-b3083e15d86c","resolution":{"observed_at":"2026-05-10T10:49:55.931690Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2604.16420","last_updated":"2026-04-03T07:35:43Z","snapshot_observed_at":"2026-08-13T14:31:34.213793Z","submitted_at":"2026-04-03T07:35:43Z","title":"Breaking Validity-Induced Boundaries to Expand Algorithm Search Space: A Two-Stage AST-Based Operator for LLM-Driven Automated Heuristic Evolution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T18:58:46.374476Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2604.16420"},"observation_digest":"sha256:2ddfb1e1dbe75779a3e813d14492d061907602c79ced3a96407d6a8b88ffd8c9","observation_id":"c181dba3-e11a-4900-838d-3f24bf8d42ac","resolution":{"observed_at":"2026-05-13T19:03:08.629593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2604.17458","last_updated":"2026-04-21T06:43:15Z","snapshot_observed_at":"2026-07-06T23:04:32.734175Z","submitted_at":"2026-04-19T14:18:49Z","title":"EHRAG: Bridging Semantic Gaps in Lightweight GraphRAG via Hybrid Hypergraph Construction and Retrieval","version":2},"reference_index":138,"source":"arxiv_source","source_observed_at":"2026-05-10T05:43:04.813867Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2604.17458"},"observation_digest":"sha256:64d0c7e862e13ac493dfeac1a6dba93c9b614da3ce183c6bfaf31e0fe5378a61","observation_id":"678c08d9-d072-496b-a20e-95b623cf4075","resolution":{"observed_at":"2026-05-10T05:51:10.705324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2604.17497","last_updated":"2026-04-19T15:32:48Z","snapshot_observed_at":"2026-08-13T08:49:00.640375Z","submitted_at":"2026-04-19T15:32:48Z","title":"Generative AI Technologies, Techniques & Tensions: A Primer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T05:39:12.226558Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2604.17497"},"observation_digest":"sha256:a1008dfff182e0890b8f1573b4236f79c976ea0cde0ecb46b1d799db7082212e","observation_id":"1eeadf0d-8f03-4fd7-95ca-eb519fefb0e0","resolution":{"observed_at":"2026-05-10T05:41:01.359287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2604.23788","last_updated":"2026-04-26T16:25:30Z","snapshot_observed_at":"2026-08-11T17:38:39.246442Z","submitted_at":"2026-04-26T16:25:30Z","title":"MIRAGE: A Micro-Interaction Relational Architecture for Grounded Exploration in Multi-Figure Artworks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T06:32:57.198044Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2604.23788"},"observation_digest":"sha256:8d98faf22dcb607c48f9a80dce8b864b649e336b96fcdcb2eae0dc41f8e6e72d","observation_id":"262ff1a5-0616-4758-a9b0-18b58c976985","resolution":{"observed_at":"2026-05-08T23:14:22.757837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2605.03111","last_updated":"2026-05-04T19:49:22Z","snapshot_observed_at":"2026-07-06T23:16:05.372336Z","submitted_at":"2026-05-04T19:49:22Z","title":"Benchmarking Local Language Models for Social Robots using Edge Devices","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T17:42:32.154484Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2605.03111"},"observation_digest":"sha256:6e2fef8dba20ce32012499f8cfcb266a39833bc7ba154981ba89dbf82cafd17b","observation_id":"55837b3c-3a7a-414d-9644-4b161be5d09a","resolution":{"observed_at":"2026-05-12T10:46:30.944729Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2605.06327","last_updated":"2026-05-07T14:23:31Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:31Z","title":"Measuring Evaluation-Context Divergence in Open-Weight LLMs: A Paired-Prompt Protocol with Pilot Evidence of Alignment-Pipeline-Specific Heterogeneity","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-08T10:23:02.697982Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2605.06327"},"observation_digest":"sha256:ad56bfdb59cdbc3975d5a917706996dc125348139310190223b9fc6fd35cb388","observation_id":"aaafe2c8-a998-4e1a-8f97-8fcab9b755bc","resolution":{"observed_at":"2026-05-08T22:04:18.057808Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2605.06423","last_updated":"2026-05-07T15:29:10Z","snapshot_observed_at":"2026-08-11T07:28:57.912238Z","submitted_at":"2026-05-07T15:29:10Z","title":"Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T09:14:12.034025Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2605.06423"},"observation_digest":"sha256:cd1cd49312d54aadabc5cbbf59e9b4692602da404f802be8b6b01dbd3a49070b","observation_id":"88099512-5af7-4d09-a27d-ec38c8d21894","resolution":{"observed_at":"2026-05-11T20:26:09.060530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2605.15393","last_updated":"2026-05-14T20:26:59Z","snapshot_observed_at":"2026-08-14T00:49:36.394834Z","submitted_at":"2026-05-14T20:26:59Z","title":"LPDS: Evaluating LLM Robustness Through Logic-Preserving Difficulty Scaling","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-19T16:33:30.850113Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2605.15393"},"observation_digest":"sha256:02de75016070361247543c91bf2c3de852f3603daf4606adf7a305eb264b7a70","observation_id":"dcc0b25d-bde2-432b-8780-93518cf488f0","resolution":{"observed_at":"2026-05-19T16:37:40.232601Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2605.20628","last_updated":"2026-06-03T18:37:01Z","snapshot_observed_at":"2026-08-02T15:50:33.967311Z","submitted_at":"2026-05-20T02:25:21Z","title":"Divide-Prompt-Refine: a Training-Free, Structure-Aware Framework for Biomedical Abstract Generation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-21T05:27:57.800080Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2605.20628"},"observation_digest":"sha256:881efade1085f8f060d852ac9c0889f2d7cb61782775114e592771e8ccb1e9d2","observation_id":"7a950c64-89e0-42c0-97f9-f5427c7c2646","resolution":{"observed_at":"2026-05-21T05:29:39.521627Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2605.20628","last_updated":"2026-06-03T18:37:01Z","snapshot_observed_at":"2026-08-02T15:50:33.967311Z","submitted_at":"2026-05-20T02:25:21Z","title":"Divide-Prompt-Refine: a Training-Free, Structure-Aware Framework for Biomedical Abstract Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T17:49:46.502337Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2605.20628"},"observation_digest":"sha256:5cb8cf33d69bb110cf1cad825df4cd153bbf73ac4ea46d36c6e1ca1a0ecd45ea","observation_id":"c323fe17-c3f2-4e60-9804-d1b3fb3a0985","resolution":{"observed_at":"2026-06-30T17:54:58.056071Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2605.23189","last_updated":"2026-05-22T03:17:14Z","snapshot_observed_at":"2026-08-08T16:05:13.996642Z","submitted_at":"2026-05-22T03:17:14Z","title":"Empirical Bayes Conformal Prediction for Vision and Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T04:45:11.816420Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2605.23189"},"observation_digest":"sha256:6a17bfd7f30da33fd9825fe7b7f6a3129abae73c574fc902c54cf290786fe632","observation_id":"e7b7cc58-f0a0-4318-96cc-0638a108a2b0","resolution":{"observed_at":"2026-05-25T04:45:19.866520Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2605.30646","last_updated":"2026-05-28T23:03:43Z","snapshot_observed_at":"2026-08-07T13:40:49.056190Z","submitted_at":"2026-05-28T23:03:43Z","title":"Same Patient, Different Words, Different Diagnosis? Evaluating Semantic Stability in Clinical LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T07:14:22.444020Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2605.30646"},"observation_digest":"sha256:0cbb29fb5d733a3b6a7f4eefe12a5563c31cbaf2b14d6fe5663a25a10021d7bb","observation_id":"e2b9edda-bfb1-4dae-820a-c49e4ea54159","resolution":{"observed_at":"2026-06-29T07:23:13.265160Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2606.07711","last_updated":"2026-06-05T13:50:59Z","snapshot_observed_at":"2026-08-12T13:12:57.679832Z","submitted_at":"2026-06-05T13:50:59Z","title":"Rosetta Memory: Adaptive Memory for Cross-LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T22:42:33.581068Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2606.07711"},"observation_digest":"sha256:09f8e96140143ab6f71a9a418f832ebf0c2f748b7232388515ecc4eb66723a7d","observation_id":"d1a4b6a0-405e-4761-ab97-cd18c19fa94e","resolution":{"observed_at":"2026-07-02T16:27:09.187540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2606.10281","last_updated":"2026-06-09T01:09:04Z","snapshot_observed_at":"2026-08-06T12:03:43.734759Z","submitted_at":"2026-06-09T01:09:04Z","title":"Benchmarking and Exploring the Capabilities of LLMs for Attack Investigations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T13:10:55.969499Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2606.10281"},"observation_digest":"sha256:e25a72c5aa09280471c8b9dac11e8afdfd710a7d5b568e6f5c18adaf309c9115","observation_id":"e558dba4-199f-4246-9359-0dfca5d6351c","resolution":{"observed_at":"2026-07-03T05:27:40.503598Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2606.20064","last_updated":"2026-06-18T10:36:03Z","snapshot_observed_at":"2026-07-31T05:49:45.638181Z","submitted_at":"2026-06-18T10:36:03Z","title":"AI Conversational Interviewing: Scaling Up Semi-Structured and In-depth Interviews","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T15:52:24.912044Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2606.20064"},"observation_digest":"sha256:637d4b58aec730bfd2353019c6fb143e266a56ef3d4d616c9e64fa0fab122784","observation_id":"7525eaf8-22c0-40ac-a349-8b2e3864b0f2","resolution":{"observed_at":"2026-06-26T17:09:36.259781Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2606.20978","last_updated":"2026-06-18T22:57:14Z","snapshot_observed_at":"2026-08-03T00:08:56.636064Z","submitted_at":"2026-06-18T22:57:14Z","title":"How Should Agents Read Demonstrations? Hierarchical Structure Beats Flat Action Logs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-26T16:50:31.233744Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2606.20978"},"observation_digest":"sha256:94da64ba991859c758ee0063cfce2a7767498c5cc163b53a30be0ef119b356d3","observation_id":"4ee5470b-ae22-469f-9bda-7d9e7c4f3c5b","resolution":{"observed_at":"2026-07-04T04:39:35.051018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2606.22917","last_updated":"2026-06-22T06:57:30Z","snapshot_observed_at":"2026-08-14T05:51:42.850131Z","submitted_at":"2026-06-22T06:57:30Z","title":"GRAIN: Group Aggregation via Min-Norm Objective","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-06-26T09:18:55.049767Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2606.22917"},"observation_digest":"sha256:d2ee80e5cc10c15ca0b8f7da365d2bd52ef689018820ca7c1536a51a60030c93","observation_id":"6653ecc8-a06e-4af0-84cd-ded82b6f3226","resolution":{"observed_at":"2026-07-04T09:59:45.321467Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2606.24828","last_updated":"2026-06-23T17:12:06Z","snapshot_observed_at":"2026-07-30T09:12:40.207344Z","submitted_at":"2026-06-23T17:12:06Z","title":"Less is More: Quality-Aware Training Data Selection for Scientific Summarization","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-25T23:42:24.557235Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2606.24828"},"observation_digest":"sha256:ea5566b5d7c32e5b2a248bf54febc1772d4b16a436a5e9e3e7bc1047f92081ee","observation_id":"dad08b86-1d6f-4140-832a-84d5682a2265","resolution":{"observed_at":"2026-07-04T17:30:00.082103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2607.00937","last_updated":"2026-07-01T13:40:25Z","snapshot_observed_at":"2026-08-06T01:17:44.474757Z","submitted_at":"2026-07-01T13:40:25Z","title":"Persona Non Grata: LLM Persona-Driven Generations in MCQA are Unstable in Distinct Dimensions","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-02T13:06:28.163476Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2607.00937"},"observation_digest":"sha256:193c194e8c2efedf1c0a9f08948e3bd4224dee579809b948c290f2e8a7bc31d3","observation_id":"95528467-b921-4ef4-a258-aeb7f84a849d","resolution":{"observed_at":"2026-07-02T13:06:58.434109Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-07-12T05:14:41.315225Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03048","last_updated":"2026-07-03T07:37:57Z","snapshot_observed_at":"2026-08-13T10:29:44.544701Z","submitted_at":"2026-07-03T07:37:57Z","title":"Compression, structure, and executor capability: a controlled real-cost decomposition of language-model agent skill optimisation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T05:14:41.315225Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2607.03048"},"observation_digest":"sha256:d3df8cd0f0a7e2db025a3e3133ba38333b63ea6c75d89b460bab5cbe177ab37c","observation_id":"2cac8b94-520a-4357-b191-e07c96772684","resolution":{"observed_at":"2026-07-12T05:14:41.315225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-07-12T04:28:33.393520Z","title":"Does prompt formatting have any impact on llm performance?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03158","last_updated":"2026-07-03T09:58:38Z","snapshot_observed_at":"2026-08-14T00:21:12.276231Z","submitted_at":"2026-07-03T09:58:38Z","title":"Which Algorithm Specification Formats Help Language Models Implement Machine Learning Algorithms?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-12T04:28:33.393520Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2607.03158"},"observation_digest":"sha256:34e28007cc6ea9ad8439d445e0e3da02d4976ea23f3359a1302b2e6d4d74f95d","observation_id":"6bdd4d66-184a-4456-a589-19273f872a44","resolution":{"observed_at":"2026-07-12T04:28:33.393520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-01T13:01:00.903193Z","title":"Kelly Hong, Anton Troynikov, and Jeff Huber","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19257","last_updated":"2026-07-21T16:31:35Z","snapshot_observed_at":"2026-08-12T15:07:22.949709Z","submitted_at":"2026-07-21T16:31:35Z","title":"Prompt Design at Scale: How Format, Instruction Count, and Context Length Shape Instruction Adherence and Hallucination in Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T13:01:00.903193Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2607.19257"},"observation_digest":"sha256:74778b15fef413e10f374d07c79d910e65d553ef4c35435930c582728fab6389","observation_id":"ebc593d1-0bb8-45b7-b291-d2cb003a23c5","resolution":{"observed_at":"2026-08-01T13:01:00.903193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-02T13:59:21.456669Z","title":"Does prompt formatting have any impact on llm performance?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20453","last_updated":"2026-05-14T20:03:14Z","snapshot_observed_at":"2026-08-12T15:06:34.798527Z","submitted_at":"2026-05-14T20:03:14Z","title":"A Knowledge-Injection Framework for Zero-Shot Adaptation of LLMs to Delirium Prediction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T13:59:21.456669Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2607.20453"},"observation_digest":"sha256:f8a73e6b272797d4caeae539965b589363652ac480a327d1ebc9850c7c54d29a","observation_id":"40a49e55-b116-4dba-b1fd-0b598563fc13","resolution":{"observed_at":"2026-08-02T13:59:21.456669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-02T13:06:41.790740Z","title":"Yupeng Chang, Xu Wang, Jindong Wang, Yuan Wu, Linyi Yang, Kaijie Zhu, Hao Chen, Xiaoyuan Yi, Cunxiang Wang, Yidong Wang, and 1 others","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24754","last_updated":"2026-05-26T05:55:29Z","snapshot_observed_at":"2026-08-14T00:21:09.613776Z","submitted_at":"2026-05-26T05:55:29Z","title":"CARE-MH: Towards Unified, Reproducible, and Comparable Evaluation of Mental Health LLMs","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T13:06:41.790740Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2607.24754"},"observation_digest":"sha256:ac85eb56f15b242fb297e9dc364eb2fea5cb2506a94081672bb218edd57ddc0c","observation_id":"d1aaddfc-fc52-457d-8797-90af08972dd5","resolution":{"observed_at":"2026-08-02T13:06:41.790740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.10541/citation-record","integrity":"/paper/2411.10541/integrity","json":"/paper/2411.10541/citation-record.json","paper":"/paper/2411.10541"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T19:38:26.284361Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.284361Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:509fa2d9c264624364ff225b52e82e38fcad3768df7061f4c9d8b7c3338c3f24","observation_id":"5744fd68-e4ba-4445-8684-60f14a112cad","resolution":{"observed_at":"2026-08-12T19:38:26.284361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:26.319377Z","title":"June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.319377Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:8a1ce54f6f5f5aeabab2d9d16ff9176dfb5b4124bf829cdb1e2e73cde6f2f807","observation_id":"137ec5c2-3d0a-45cc-a2b4-c92b2731d5fc","resolution":{"observed_at":"2026-08-12T19:38:26.319377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T19:38:26.347769Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.347769Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:80e27da7a3906ff0dc6eddf9b3defe457736e250a1fe1fc4d68567b9a6dad10a","observation_id":"267bbb49-5848-4da6-8ed8-f2d7d47cfddb","resolution":{"observed_at":"2026-08-12T19:38:26.347769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-12T19:38:26.361331Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.361331Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:d1e7788e37d9ce218ae1693abb0e47d779f0401d316efdd039f3ba6c8b30c9d0","observation_id":"5a5f221c-68f2-498f-9b29-717933e22a00","resolution":{"observed_at":"2026-08-12T19:38:26.361331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06634","last_updated":"2024-07-09T17:44:00Z","snapshot_observed_at":"2026-08-13T00:57:43.847856Z","submitted_at":"2024-03-11T11:46:12Z","title":"Stealing Part of a Production Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06634","snapshot_observed_at":"2026-08-12T19:38:26.367067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.367067Z"},"links":{"cited_paper":"/paper/2403.06634","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:7a0610b569b040db687a5be26a67e507b9c3189fda1797abe54c2d3099a5c9f7","observation_id":"c9f6403f-12c6-4879-a935-d77cd372941d","resolution":{"observed_at":"2026-08-12T19:38:26.367067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-12T19:38:26.372643Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.372643Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:f0dac3cae115b98ce71d048d442778b959a1f0ea96af8dc589555a85a1b28733","observation_id":"7b6fb563-6dc2-4e30-a806-4c17abc4eef8","resolution":{"observed_at":"2026-08-12T19:38:26.372643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-12T19:38:26.379272Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.379272Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:6d88fcc55d1e43a244409e1b4149cfb6f9a91528c285746aadf3647cba3890c3","observation_id":"57d8e1ca-9f63-4699-897b-2970de98de47","resolution":{"observed_at":"2026-08-12T19:38:26.379272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-12T19:38:26.420758Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.420758Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:68b9c4262f119ae34e11686e8136cd688d555b7eb69994ea1e51f42a2988d396","observation_id":"46477ffa-d97d-45d5-a94f-21a199a0c851","resolution":{"observed_at":"2026-08-12T19:38:26.420758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11401","last_updated":"2021-04-12T15:42:18Z","snapshot_observed_at":"2026-08-07T05:44:30.677502Z","submitted_at":"2020-05-22T21:34:34Z","title":"Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11401","snapshot_observed_at":"2026-08-12T19:38:26.485589Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.485589Z"},"links":{"cited_paper":"/paper/2005.11401","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:6bc2163d06c507571745264e7bbb72648dd15d55d8daba01d54ddce73cdb815a","observation_id":"e1b02c7e-0727-444f-8291-92fb3b89f17c","resolution":{"observed_at":"2026-08-12T19:38:26.485589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-12T19:38:26.571081Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.571081Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:5a96a2ecc59c6a59520096c9369ad14afc9c7baadbca4f7cd1fb4c3fd3af2cf0","observation_id":"8d4f2e14-c169-45be-9152-90cf00e57b2a","resolution":{"observed_at":"2026-08-12T19:38:26.571081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-08-12T19:38:26.600322Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.600322Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:9297c2f4104f5323fa9ce4b8f58da6e1a09f68cc3c596b90ca71eddd663c279d","observation_id":"9f288c2d-a0f4-450c-98fd-6a995126e4be","resolution":{"observed_at":"2026-08-12T19:38:26.600322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04664","last_updated":"2021-03-16T08:28:37Z","snapshot_observed_at":"2026-07-06T10:39:42.676631Z","submitted_at":"2021-02-09T06:16:25Z","title":"CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04664","snapshot_observed_at":"2026-08-12T19:38:26.632560Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.632560Z"},"links":{"cited_paper":"/paper/2102.04664","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:9be4c64dc36ca27f65207dc8e0114edd49db3e55475c3cb64d86a8e01c6c0eb5","observation_id":"044bb79b-65d9-483c-a869-d45924ee7354","resolution":{"observed_at":"2026-08-12T19:38:26.632560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08786","last_updated":"2022-03-03T12:10:58Z","snapshot_observed_at":"2026-07-06T11:01:05.577957Z","submitted_at":"2021-04-18T09:29:16Z","title":"Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08786","snapshot_observed_at":"2026-08-12T19:38:26.668373Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.668373Z"},"links":{"cited_paper":"/paper/2104.08786","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:64d2e8998ca7a4712ed1dafe6b6a55b2a545f7af06af7d86ecefb8c04ea8edb5","observation_id":"0e20dc1e-713a-479b-bde3-987698ad7953","resolution":{"observed_at":"2026-08-12T19:38:26.668373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:28.027992Z","title":"guidance","venue":null,"work_id":"88c3ab22-9309-4ef1-89fc-39a03c749c96","year":null},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.690449Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:dd9e54c2d1dba8a530f8a75ebb50294f44a83c931bf9c4bcb879ae1225a68ab8","observation_id":"6bd33771-dd12-4454-89b4-d84241a4f5c6","resolution":{"observed_at":"2026-08-12T19:38:28.032932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:27.999856Z","title":null,"venue":null,"work_id":"fb4c4c6e-faef-460f-8d3d-0bba98c7d867","year":2024},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.704308Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:61a6a0892b7ab11be1977ad1e8f5b756b04a26269dcd729880a575451915aada","observation_id":"cf3be589-e28d-439e-b38e-ded1b1575564","resolution":{"observed_at":"2026-08-12T19:38:28.009513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:27.982381Z","title":null,"venue":null,"work_id":"e44ce599-9103-4298-96fc-cfae0405fb32","year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.708565Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:53a7d29293ba8861b98c8fe293ae3403859499bdf80d84fbf5d03823da64e5b4","observation_id":"f493b6ed-082c-48b8-b6b5-fd3a51ecd444","resolution":{"observed_at":"2026-08-12T19:38:27.986813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:27.947759Z","title":null,"venue":null,"work_id":"01a18b6a-a4e0-48a0-9630-dce9e31429e2","year":2024},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.713485Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:a4717cfd0b2268909e5f3c27913bceb83bd9b504e77fd42da2e3d9dad43d978f","observation_id":"551c644b-efeb-467e-bd67-8c81ca6e0607","resolution":{"observed_at":"2026-08-12T19:38:27.972032Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:27.877373Z","title":"November 2023","venue":null,"work_id":"c67c430c-318d-4c94-8895-96f4f77cdf92","year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.719236Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:376abe8a5ced5ac02db0a1fc626bd14f39a446120983ccc2473459ccd5e921cb","observation_id":"8c4fde01-c780-45f2-873e-0310eb7ca1c4","resolution":{"observed_at":"2026-08-12T19:38:27.901791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-12T19:38:26.723860Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.723860Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:0d70f411a5490a8dfc8d3ac1671720bb523f53fd79c10031e6a2f0248c1bf069","observation_id":"e2e8d5dd-d24d-4bb3-88d9-4935adac9763","resolution":{"observed_at":"2026-08-12T19:38:26.723860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:26.736034Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.736034Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:765c9ff67ed5e2e4e21a3bc81770f8b9a5cca6f111490ab4dbf7ee7716b95ed7","observation_id":"a905d37c-1cbc-4fc8-8186-e356eff90cb7","resolution":{"observed_at":"2026-08-12T19:38:26.736034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07927","last_updated":"2025-03-16T06:23:34Z","snapshot_observed_at":"2026-08-05T17:55:26.008016Z","submitted_at":"2024-02-05T19:49:13Z","title":"A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07927","snapshot_observed_at":"2026-08-12T19:38:26.741026Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.741026Z"},"links":{"cited_paper":"/paper/2402.07927","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:ad3bc9fc49a8857b9b2fb2f4cb4fabadba700c5b30447bdd84db9e8027d80466","observation_id":"ebfa0603-b794-4678-bc1e-f9de9a375eb9","resolution":{"observed_at":"2026-08-12T19:38:26.741026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03886","last_updated":"2023-12-08T05:18:40Z","snapshot_observed_at":"2026-08-13T10:18:21.254756Z","submitted_at":"2023-09-07T17:47:26Z","title":"FIND: A Function Description Benchmark for Evaluating Interpretability Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03886","snapshot_observed_at":"2026-08-12T19:38:26.746856Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.746856Z"},"links":{"cited_paper":"/paper/2309.03886","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:e659d5196dabdf634b7115f74b3322949288231d56af3f1264d1d0d760ab49d4","observation_id":"1e21ac98-9ddd-4c3a-b47c-11598659bb17","resolution":{"observed_at":"2026-08-12T19:38:26.746856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11324","last_updated":"2024-07-01T22:28:01Z","snapshot_observed_at":"2026-08-12T15:05:30.306144Z","submitted_at":"2023-10-17T15:03:30Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11324","snapshot_observed_at":"2026-08-12T19:38:26.789374Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.789374Z"},"links":{"cited_paper":"/paper/2310.11324","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:40cc40088499f6ae874b5ef2bd5c40d00dc2537091b987d79ceb12174896665d","observation_id":"cf5aaaec-a456-484e-9538-44747de18621","resolution":{"observed_at":"2026-08-12T19:38:26.789374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09718","last_updated":"2024-04-01T20:51:03Z","snapshot_observed_at":"2026-08-13T05:24:02.527779Z","submitted_at":"2023-11-16T09:50:53Z","title":"You don't need a personality test to know these models are unreliable: Assessing the Reliability of Large Language Models on Psychometric Instruments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09718","snapshot_observed_at":"2026-08-12T19:38:26.861069Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.861069Z"},"links":{"cited_paper":"/paper/2311.09718","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:0c21858fabb2d1b2b75d99707915ee017c6caf2220725f15419913630da38bb3","observation_id":"b76bfd8f-aef8-4d20-94b1-be4ab53f88da","resolution":{"observed_at":"2026-08-12T19:38:26.861069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:27.796439Z","title":null,"venue":null,"work_id":"96cc5388-8ae7-47d4-97c6-bc5012a79751","year":2024},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.942447Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:ba34a0a5dcae87686a5e37a16d374dce9b0aa68cecbec39844995c553ac96fba","observation_id":"f3fef87a-ee65-4503-a96b-31cff8e201b6","resolution":{"observed_at":"2026-08-12T19:38:27.826775Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T19:38:26.986317Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:26.986317Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:7deef34f7ddb2a58f06cdb921ddd4e64a4dfd9cb4d1995cf010eed61037eb414","observation_id":"ad907e1a-7551-4de8-ab47-c0f4b22bc895","resolution":{"observed_at":"2026-08-12T19:38:26.986317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T19:38:27.017777Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.017777Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:7835a153e38b3f7aca56a07a816e776effb1096089a1c1b48c907d1c1c845324","observation_id":"a2771637-510b-49b0-92db-c2bf2c81f764","resolution":{"observed_at":"2026-08-12T19:38:27.017777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06766","last_updated":"2024-06-06T19:01:37Z","snapshot_observed_at":"2026-08-13T04:43:44.222799Z","submitted_at":"2024-01-12T18:58:26Z","title":"Mind Your Format: Towards Consistent Evaluation of In-Context Learning Improvements","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06766","snapshot_observed_at":"2026-08-12T19:38:27.040197Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.040197Z"},"links":{"cited_paper":"/paper/2401.06766","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:6ae95fc14add5e36fbc89f9ff87159649098fad07fd0c7bf361d2ce6bca69f22","observation_id":"acfbff11-cc1a-4455-a953-b6690b06a1d3","resolution":{"observed_at":"2026-08-12T19:38:27.040197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-12T19:38:27.057395Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.057395Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:7e721ee3d9ee3bb43fee09802504c61a652e24f1c74d0fb19acd056ad1db9473","observation_id":"621a8185-b1d1-4fc0-aca6-c3418bc44833","resolution":{"observed_at":"2026-08-12T19:38:27.057395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-12T19:38:27.062016Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.062016Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:9c2ede02f4b0ea68ef3b5df9f84d7a5a7fcbbe53266a1596cba238299e9aa2e9","observation_id":"6e46cbc9-c2e6-4e61-87a7-5a8fe9b148c7","resolution":{"observed_at":"2026-08-12T19:38:27.062016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-12T19:38:27.066916Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.066916Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:2a5b26ad255566b015ae97dbe72cc6c8f674ee2ed841a2bdaee11c8d9dd87581","observation_id":"ffb16315-0ec1-416b-ab40-42e107385191","resolution":{"observed_at":"2026-08-12T19:38:27.066916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-12T19:38:27.072574Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.072574Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:e2487a33ca4e812a55e8f5508dd8625226bc59f72481b69f7a629b6f4476aaf2","observation_id":"ff45f939-abc8-4c1d-82c4-bf2eff5b7c73","resolution":{"observed_at":"2026-08-12T19:38:27.072574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09690","last_updated":"2021-06-10T18:20:59Z","snapshot_observed_at":"2026-08-10T20:03:40.241346Z","submitted_at":"2021-02-19T00:23:59Z","title":"Calibrate Before Use: Improving Few-Shot Performance of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09690","snapshot_observed_at":"2026-08-12T19:38:27.077687Z","title":"Zhao, Eric Wallace, Shi Feng, Dan Klein, and Sameer Singh","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.077687Z"},"links":{"cited_paper":"/paper/2102.09690","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:8c6a9219a7a436d4a79556c14c8afddd67d87384db234926d1c211bb6fd52cd3","observation_id":"a53ceb04-acb6-4917-8358-cd36cd6aadf5","resolution":{"observed_at":"2026-08-12T19:38:27.077687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17568","last_updated":"2024-07-10T03:52:58Z","snapshot_observed_at":"2026-08-14T08:57:49.577104Z","submitted_at":"2023-03-30T17:34:01Z","title":"CodeGeeX: A Pre-Trained Model for Code Generation with Multilingual Benchmarking on HumanEval-X","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17568","snapshot_observed_at":"2026-08-12T19:38:27.082228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.082228Z"},"links":{"cited_paper":"/paper/2303.17568","citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:0af358eda499a11cadfd88712647801eae7d5e1cd780cf734a7c3e0717be5d96","observation_id":"9feac7ef-e7c7-442f-a1fc-9120e5447d21","resolution":{"observed_at":"2026-08-12T19:38:27.082228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:27.100239Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.100239Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:27004f08da10c444ea103bc1e72006b80e7389f35ed01c4d60bd726fc5a75225","observation_id":"c11ca677-5541-455f-a4ca-a0a23e7a95c7","resolution":{"observed_at":"2026-08-12T19:38:27.100239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:38:27.146182Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T19:38:27.146182Z"},"links":{"citing_paper":"/paper/2411.10541"},"observation_digest":"sha256:8e5cceea56bb7fcf07bb9666ed07e93f2cdf5d4f6dc2675a97f36ddda4f3fa18","observation_id":"fe8853bc-d6dc-4aee-8213-4145d7d78b05","resolution":{"observed_at":"2026-08-12T19:38:27.146182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T19:33:02.215393Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 47 inbound Pith citation observations for arXiv:2411.10541."}