{"as_of":"2026-08-20T05:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:70e543451b6190a1d27b59b88c4950453e1e1e5b3988f6d4b6a4217f3a948bfa","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:21:28.151808Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:12:14.146302Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:12:24.245674Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"cited_work":{"arxiv_id":"2411.16797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16797","snapshot_observed_at":"2026-06-28T17:12:24.245674Z","title":"Amiri-Margavi, I","venue":null,"work_id":"b48ed615-e400-4ed5-b713-4ecd57b74d90","year":2025},"citing_paper":{"arxiv_id":"2506.05425","last_updated":"2026-04-28T02:01:09Z","snapshot_observed_at":"2026-08-20T00:15:58.158571Z","submitted_at":"2025-06-05T05:51:35Z","title":"SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T11:36:36.687324Z"},"links":{"cited_paper":"/paper/2411.16797","citing_paper":"/paper/2506.05425"},"observation_digest":"sha256:7912b94601b3a844720f450ea7a864fd05bd277e052c8804cfd445ffc28ccbe3","observation_id":"b6c747e7-9df5-4b07-b6d4-2880cad55f2f","resolution":{"observed_at":"2026-05-19T11:37:15.735769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"cited_work":{"arxiv_id":"2411.16797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16797","snapshot_observed_at":"2026-06-28T17:12:24.245674Z","title":"Amiri-Margavi, I","venue":null,"work_id":"b48ed615-e400-4ed5-b713-4ecd57b74d90","year":2025},"citing_paper":{"arxiv_id":"2606.01456","last_updated":"2026-05-31T21:30:43Z","snapshot_observed_at":"2026-08-13T02:21:53.174988Z","submitted_at":"2026-05-31T21:30:43Z","title":"Truthful AI Advisors: A Pre-Specified Benchmark for Large Language Model Honesty Under Preference Misalignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T17:12:14.146302Z"},"links":{"cited_paper":"/paper/2411.16797","citing_paper":"/paper/2606.01456"},"observation_digest":"sha256:01cde14bd7de9be12bd6f61670b29099a37ad0ba56c440f8d16c5a6caf83473c","observation_id":"aed2077d-01a0-4a6c-ae0b-56bd1a8115af","resolution":{"observed_at":"2026-06-28T17:12:24.247068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.16797/citation-record","integrity":"/paper/2411.16797/integrity","json":"/paper/2411.16797/citation-record.json","paper":"/paper/2411.16797"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T13:21:28.011334Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.011334Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:9c29923b703413433ebb7c71a8efde530b845bd9794ed940d17a4ca1ac74ecc5","observation_id":"95bc0cae-529f-4883-8a40-ca69200b221a","resolution":{"observed_at":"2026-08-12T13:21:28.011334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05194","last_updated":"2025-03-29T17:29:24Z","snapshot_observed_at":"2026-08-16T13:53:59.132328Z","submitted_at":"2024-06-07T18:21:26Z","title":"LLMs Are Not Intelligent Thinkers: Introducing Mathematical Topic Tree Benchmark for Comprehensive Evaluation of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05194","snapshot_observed_at":"2026-08-12T13:21:28.045862Z","title":"Llms are not intelli- gent thinkers: Introducing mathematical topic tree benchmark for comprehensive evaluation of llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.045862Z"},"links":{"cited_paper":"/paper/2406.05194","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:ff5174753e0ef3b744fe97bd57ae573b2df59ac9277c2dd90ca35772986e2895","observation_id":"a87d9bb1-b8f4-412e-a86e-1c7728b940ef","resolution":{"observed_at":"2026-08-12T13:21:28.045862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-12T13:21:28.057753Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.057753Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:c10b22058cce94972fd94d80ff06104a4d683b90711aea59e4be5e23929160f9","observation_id":"19300bb6-215f-4525-8c1b-dfba43ff98a7","resolution":{"observed_at":"2026-08-12T13:21:28.057753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-12T13:21:28.069139Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.069139Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:5b7f961b4d201dbee46f33cf106d49af45f334a5fa5b99b54a34b6cc488c6a36","observation_id":"61f6a845-ddc3-4742-a7ea-4ee0279e2fe5","resolution":{"observed_at":"2026-08-12T13:21:28.069139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.577531Z","title":"Improving fairness in machine learning systems: What do industry practitioners need? In Proceedings of the 2019 CHI conference on human factors in computing systems, pages 1–16,","venue":null,"work_id":"a78a8094-0329-4907-8bba-79e17d9e7096","year":2019},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.074657Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:7d234ba7f9f9923e944492b58548eacd1240574e04ed7d02c99e468d7add8046","observation_id":"cae75261-3045-4195-a7a9-874e2055e0ce","resolution":{"observed_at":"2026-08-12T13:21:28.583008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.559057Z","title":"Harnessing the wisdom of crowds in wikipedia: quality through coordination","venue":null,"work_id":"dbca3906-590b-4e06-95b1-12eb57a05ab1","year":2008},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.086707Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:aeb9cd7cdd24d1e028dae629d3d17c58d93c5b6482f2fe6612e8836852acd028","observation_id":"53caf2f2-4260-4faa-9023-f7f2b949041c","resolution":{"observed_at":"2026-08-12T13:21:28.565545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06089","last_updated":"2024-07-08T16:29:08Z","snapshot_observed_at":"2026-08-18T00:42:07.586569Z","submitted_at":"2024-07-08T16:29:08Z","title":"Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06089","snapshot_observed_at":"2026-08-12T13:21:28.096521Z","title":"Merge, ensemble, and cooperate! a survey on collaborative strategies in the era of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.096521Z"},"links":{"cited_paper":"/paper/2407.06089","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:1816fd54d9b48f3448b824e4e1d95e6b5a61e1c919f4b3a17921f48c8f1b4ca7","observation_id":"4e4c0ce4-9ec1-4d48-8447-56aa6fd17594","resolution":{"observed_at":"2026-08-12T13:21:28.096521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T13:21:28.101763Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.101763Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:fb41885d08c78800eb87b0f58c8efb034ddf047e444aeade8beac6859eca4655","observation_id":"ba4b6d1c-96ff-45b9-b14a-67e25f3d780f","resolution":{"observed_at":"2026-08-12T13:21:28.101763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.542576Z","title":"Brent Mittelstadt","venue":null,"work_id":"bc2336ff-6a2a-4323-ae5b-b1505f77d343","year":2023},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.107527Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:d3ab86385fad7a3bc3d41c48f9dff78c83c2636df210a88c429e324dae34b231","observation_id":"27e43cd9-f0eb-4806-acb8-f83fa111fd6c","resolution":{"observed_at":"2026-08-12T13:21:28.547773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.525114Z","title":"Mitigating bias in algorithmic hiring: Evaluating claims and practices","venue":null,"work_id":"03f15a02-4f97-4daa-90b6-59a9be7e66ed","year":2020},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.117355Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:d0dd3408e9a397fb83638c58dd4ea5264c4212b5e5cbda3ee3659e7e00180398","observation_id":"34c92536-b659-430a-97b9-ef7c8ab81621","resolution":{"observed_at":"2026-08-12T13:21:28.530508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00280","last_updated":"2024-08-21T05:11:10Z","snapshot_observed_at":"2026-08-18T18:44:59.139119Z","submitted_at":"2023-09-30T07:11:39Z","title":"Corex: Pushing the Boundaries of Complex Reasoning through Multi-Model Collaboration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00280","snapshot_observed_at":"2026-08-12T13:21:28.122091Z","title":"Corex: Pushing the boundaries of complex reasoning through multi-model collaboration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.122091Z"},"links":{"cited_paper":"/paper/2310.00280","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:988d7727f4b25827a8d8cb56071242f3cf15476c8e7bc8c44cbb23a7d447c3a0","observation_id":"503f515d-7c8f-469f-9462-2aea3a1d1f8f","resolution":{"observed_at":"2026-08-12T13:21:28.122091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09085","last_updated":"2022-11-16T18:06:33Z","snapshot_observed_at":"2026-08-17T08:35:32.078396Z","submitted_at":"2022-11-16T18:06:33Z","title":"Galactica: A Large Language Model for Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09085","snapshot_observed_at":"2026-08-12T13:21:28.127021Z","title":"Galactica: A large language model for science","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.127021Z"},"links":{"cited_paper":"/paper/2211.09085","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:1a0d7f504749a89dbdb9f74617e1bcd8be884047328ad14f3dda3bc68118e1e5","observation_id":"2601fffa-15fa-4834-b521-b3049b48088b","resolution":{"observed_at":"2026-08-12T13:21:28.127021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T13:21:28.131826Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.131826Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:70f302534efb195f8526d2793c83c10a14ab5f7c4be5da15fe95c70d08577d3c","observation_id":"e6b5a435-7c4b-4712-a09f-a082c53473a9","resolution":{"observed_at":"2026-08-12T13:21:28.131826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T13:21:28.136780Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.136780Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:84110035ccdce6dc98ac2914f18474e065bdccace38d0d3748a752eeba92a397","observation_id":"eb19abfe-7bb2-4ca8-933e-5ed0ada9733e","resolution":{"observed_at":"2026-08-12T13:21:28.136780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.508037Z","title":"The collective intelligence of random small crowds: A partial replication of kosinski et al.(2012)","venue":null,"work_id":"2936cba5-692f-4ebb-bc5e-4be7beb3c9c2","year":2012},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.142188Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:3eed1232e12aa8bfaf9d38efc0d3d94ea05bf82cdd5489bd567ee0127555e3c6","observation_id":"54595ea8-8143-4981-a0fb-8dd4dd0d188d","resolution":{"observed_at":"2026-08-12T13:21:28.513679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.488262Z","title":"Deep learn- ing for computer vision: A brief review","venue":null,"work_id":"378928fd-3715-41e0-ac5a-bfd752849d39","year":2018},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.146899Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:e7bca2c905e3372ab8efc40dc974346e43e37580e0239377da715bf5f6e725e4","observation_id":"6fe34682-5c77-4a20-96ab-403d2b2a1928","resolution":{"observed_at":"2026-08-12T13:21:28.495559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09606","last_updated":"2025-03-21T04:57:45Z","snapshot_observed_at":"2026-08-18T21:57:42.434501Z","submitted_at":"2024-03-14T17:47:20Z","title":"Large Language Models and Causal Inference in Collaboration: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09606","snapshot_observed_at":"2026-08-12T13:21:28.091534Z","title":"Large language models and causal inference in collaboration: A comprehensive survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.091534Z"},"links":{"cited_paper":"/paper/2403.09606","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:f47ad4f67dba3062e55d3e198590a5e1c8fc832825063af88378b69084370d2d","observation_id":"12b2009c-b670-415f-9e3a-f3a2d16cb20f","resolution":{"observed_at":"2026-08-12T13:21:28.091534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.01134","last_updated":"2019-12-20T20:03:56Z","snapshot_observed_at":"2026-08-18T06:47:35.593870Z","submitted_at":"2017-11-03T12:54:51Z","title":"Accountability of AI Under the Law: The Role of Explanation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.01134","snapshot_observed_at":"2026-08-12T13:21:28.051711Z","title":"Accountability of ai under the law: The role of explanation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.051711Z"},"links":{"cited_paper":"/paper/1711.01134","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:ece1b4b5610b218d410c15da728c2500f5df89aa3b03e9d00d3ae6c99d742d54","observation_id":"d569f57f-47d3-42e4-8597-0465ff4f3ff7","resolution":{"observed_at":"2026-08-12T13:21:28.051711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12715","last_updated":"2024-05-30T16:59:56Z","snapshot_observed_at":"2026-08-19T11:38:45.790535Z","submitted_at":"2024-04-19T08:52:22Z","title":"Ensemble Learning for Heterogeneous Large Language Models with Deep Parallel Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12715","snapshot_observed_at":"2026-08-12T13:21:28.081674Z","title":"Enabling ensemble learning for heterogeneous large language models with deep parallel collaboration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.081674Z"},"links":{"cited_paper":"/paper/2404.12715","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:f8675932821f8352bdda813d22dcc15b209c306bfae763c3149eaa3bc724ce54","observation_id":"0854f7bf-941b-457e-9c80-7013be8bdfc7","resolution":{"observed_at":"2026-08-12T13:21:28.081674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01823","last_updated":"2023-12-04T11:53:56Z","snapshot_observed_at":"2026-08-16T14:37:54.195547Z","submitted_at":"2023-12-04T11:53:56Z","title":"Exchange-of-Thought: Enhancing Large Language Model Capabilities through Cross-Model Communication","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01823","snapshot_observed_at":"2026-08-12T13:21:28.151808Z","title":"Exchange-of-thought: Enhancing large language model capabilities through cross-model communication","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.151808Z"},"links":{"cited_paper":"/paper/2312.01823","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:faebd276abd33c900f43010aa8c1f07844c1849b0da5d0f0cd7765efe0dee649","observation_id":"3c86ee35-6580-4e3e-a5d9-06b33a76a49f","resolution":{"observed_at":"2026-08-12T13:21:28.151808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.028565Z","title":"On the dangers of stochastic parrots: Can language models be too big? In Proceedings of the 2021 ACM conference on fairness, accountability, and transparency, pages 610–623,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.028565Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:1f1b1bbcd53d86e7034956d9c1216e383f36602942b6563d20bdd8369c05071e","observation_id":"9d7ca5ef-e005-41ae-b3dc-9c4b0dc066d4","resolution":{"observed_at":"2026-08-12T13:21:28.028565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06535","last_updated":"2024-11-10T17:32:16Z","snapshot_observed_at":"2026-08-18T13:46:36.313793Z","submitted_at":"2024-11-10T17:32:16Z","title":"Probabilistic Consensus through Ensemble Validation: A Framework for LLM Reliability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06535","snapshot_observed_at":"2026-08-12T13:21:28.112281Z","title":"Probabilistic consensus through ensemble validation: A framework for llm reliability","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.112281Z"},"links":{"cited_paper":"/paper/2411.06535","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:931b1b5fe67b718fd6b5ef3bf31a75268df78cf4133cf1faa2f9a60de0d52db8","observation_id":"f8771898-a9fa-4b81-966d-fd942435a37a","resolution":{"observed_at":"2026-08-12T13:21:28.112281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.08630","last_updated":"2020-12-15T21:39:50Z","snapshot_observed_at":"2026-08-19T20:01:03.239868Z","submitted_at":"2020-12-15T21:39:50Z","title":"Open Problems in Cooperative AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.08630","snapshot_observed_at":"2026-08-12T13:21:28.040010Z","title":"Open problems in cooperative ai","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.040010Z"},"links":{"cited_paper":"/paper/2012.08630","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:e9956d0442a60726b410a1bdb3803516b2812701f0da53c6c69fe2639c0a5381","observation_id":"48530819-7c65-4fbe-ab5d-a983f3184455","resolution":{"observed_at":"2026-08-12T13:21:28.040010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-12T13:21:28.034743Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.034743Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:ff9bead4a87f0a9310db9cbcb2f745fa257f9f202db5a467d25d9f92f3406604","observation_id":"05d23a2e-e037-42cb-94c6-a462d9c0d66b","resolution":{"observed_at":"2026-08-12T13:21:28.034743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.594491Z","title":"Fairness without demograph- ics in repeated loss minimization","venue":null,"work_id":"a2741d51-e58d-4538-b4bb-330c9ec3340e","year":1929},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.063661Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:0c6ab295e095a7b6aa395a3814ecaa648efbffba5cf408b9eeb1a8dd60a4c625","observation_id":"09915226-6215-4d05-90b2-57f47b6f486b","resolution":{"observed_at":"2026-08-12T13:21:28.599437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00157","last_updated":"2024-09-16T19:20:59Z","snapshot_observed_at":"2026-08-16T14:22:43.713388Z","submitted_at":"2024-01-31T20:26:32Z","title":"Large Language Models for Mathematical Reasoning: Progresses and Challenges","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00157","snapshot_observed_at":"2026-08-12T13:21:28.017481Z","title":"Large language models for mathematical reasoning: Progresses and challenges","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.017481Z"},"links":{"cited_paper":"/paper/2402.00157","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:987839122e642711cdc5bd3720695003a58b31bb0ff68c322e7e9f74ee7e25f8","observation_id":"6d595faf-8b1c-4b46-bc1c-6a69ebc3f796","resolution":{"observed_at":"2026-08-12T13:21:28.017481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.621126Z","title":"Anthropic","venue":null,"work_id":"9e2687c8-ccf3-4324-ac4c-f479a8c2f7ba","year":2024},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.022885Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:4b080dcf442a3c0acba1d70304bf27f81c3e88e8fd2d4bfb14beb0a55b61d0e0","observation_id":"42229a8a-2355-4e89-9290-239f8a47b5af","resolution":{"observed_at":"2026-08-12T13:21:28.626772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T20:25:40.307352Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 2 inbound Pith citation observations for arXiv:2411.16797."}