{"as_of":"2026-08-16T10:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d02b42df12a1bf19bdd86dc6837a2a9f3d0adca5d6c617882f6b89614fed27c3","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:33:57.230753Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07419/citation-record","integrity":"/paper/2608.07419/integrity","json":"/paper/2608.07419/citation-record.json","paper":"/paper/2608.07419"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.754591Z","title":"Proceedings of the International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.754591Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:e12a989fc64c259f586faca2b86fc3b337b55fa6ada0386b08490c14f5f6dcc6","observation_id":"af725466-9290-4f15-945c-c41b9016e78f","resolution":{"observed_at":"2026-08-15T14:33:56.754591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.760515Z","title":"Proceedings of the Conference on Health, Inference, and Learning (CHIL) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.760515Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:a71987133e007eb4e6a15c8ecb8b7cf573cc5a064bb94f6ba7bb5900d19acb74","observation_id":"9e11b084-d823-4566-b3cb-1899c01bb4a3","resolution":{"observed_at":"2026-08-15T14:33:56.760515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.765856Z","title":"Proceedings of the Conference on Empirical Methods in Natural Language Processing (EMNLP) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.765856Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:759590e2a6660ea9a27f4a3e207b1e7d146e320423670e587ea99f0130b6b5d9","observation_id":"8e3f9fe9-299f-43d8-8a86-5f5084637103","resolution":{"observed_at":"2026-08-15T14:33:56.765856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.770554Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.770554Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:ae48b1516211522d1988591b41f60f17fb98713537fa250df1b8697e567b3a86","observation_id":"2f22d196-231b-4bd2-ab90-14a380b7b042","resolution":{"observed_at":"2026-08-15T14:33:56.770554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.775387Z","title":"International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.775387Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:72b9a6fd3e1b805b5af63061871d60ce0a61ce87f0895dee6685c4b3c25370e0","observation_id":"f2e27860-9240-4fec-a9b2-d78ee688846f","resolution":{"observed_at":"2026-08-15T14:33:56.775387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.780891Z","title":"See https://vicuna","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.780891Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:b349c088b461d37beed962b5cc1379e01e835317343a01e6d1053e22487535d8","observation_id":"a80c003c-ef58-4b3d-83a1-b7e416fb3b77","resolution":{"observed_at":"2026-08-15T14:33:56.780891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T14:33:56.785705Z","title":"arXiv preprint arXiv:2307.09288 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.785705Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:d979574e672b3d30373bf1a75da97a72181659d0ade1be3987f751f839815fda","observation_id":"df87f760-94bf-4307-951c-f680c6274283","resolution":{"observed_at":"2026-08-15T14:33:56.785705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T14:33:56.791884Z","title":"arXiv preprint arXiv:2310.06825 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.791884Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:2d3710a19f7bfdef81580935b0a9640863b7613656f9aa31752c1e01e3e8f6ef","observation_id":"d3d55bce-1982-437d-9060-c4c965a9c3bb","resolution":{"observed_at":"2026-08-15T14:33:56.791884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-15T14:33:56.796696Z","title":"arXiv preprint arXiv:2408.00118 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.796696Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:06276a00dd8290763db98ea55694221193844912638e10d821ea76a103e1866f","observation_id":"6aa7d3ca-5bd3-46b9-943c-80de4e7e29f7","resolution":{"observed_at":"2026-08-15T14:33:56.796696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-08T06:58:44.493777Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T14:33:56.801493Z","title":"arXiv preprint arXiv:2501.00656 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.801493Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:e281fe0b4c68f6330087bece4beb5c0462cdaf0f69b0b6105a648d88d78397ff","observation_id":"7eb5ac86-6185-4073-9f70-fa6dd6563a14","resolution":{"observed_at":"2026-08-15T14:33:56.801493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-10T16:05:13.426341Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-15T14:33:56.806565Z","title":"arXiv preprint arXiv:2411.15124 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.806565Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:5f825363ab70c222deb13c456321d68bbf99f013bac9d29fcc5eb5659dd3ae8b","observation_id":"cffbec35-f61b-4bf4-8211-eec3f6d70f88","resolution":{"observed_at":"2026-08-15T14:33:56.806565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.811359Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.811359Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:c40d7bcb9517375f8839970746282e9a038f41aa4a9a8afd72833daf6b70344c","observation_id":"7f79b5be-e89d-454e-ab4d-c9b1ab1bd94b","resolution":{"observed_at":"2026-08-15T14:33:56.811359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06548","last_updated":"2017-01-23T18:35:28Z","snapshot_observed_at":"2026-08-14T21:19:55.038511Z","submitted_at":"2017-01-23T18:35:28Z","title":"Regularizing Neural Networks by Penalizing Confident Output Distributions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06548","snapshot_observed_at":"2026-08-15T14:33:56.816397Z","title":"arXiv preprint arXiv:1701.06548 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.816397Z"},"links":{"cited_paper":"/paper/1701.06548","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:50477078290cb326605705fa6644043612cbe5b18874a93b432e953fb5e1aa52","observation_id":"dc58164b-999d-43dc-be7c-afc4ba89f1b4","resolution":{"observed_at":"2026-08-15T14:33:56.816397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.821577Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.821577Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:8ac19976dc073a9b479b44451dc6aa06ef464abef0b80d8cf0230dd5ad3c2a4a","observation_id":"ad098449-90b8-422c-ac0d-ef6f187875b5","resolution":{"observed_at":"2026-08-15T14:33:56.821577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.825943Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.825943Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:46e0bd6ad833ea92e2d91d7a0dc9218051c4ae0244c60c7c1f159cfaee2ac802","observation_id":"37d044b7-be8d-42fc-8f9d-dbd4660254e0","resolution":{"observed_at":"2026-08-15T14:33:56.825943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.830329Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.830329Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:45189a14826cdded35bcabca1d88b9a01dc709f54bdcc0ef608971417dc4a419","observation_id":"2ed7946f-e95e-4126-a3e2-d660359bc3e6","resolution":{"observed_at":"2026-08-15T14:33:56.830329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.835665Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.835665Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:d1ed5dd87f8d76475538a4179c533a252c1338eb24d5736ede7d43e35a66bc73","observation_id":"7a7116e4-d601-4651-87c6-cdb5f7fcb6db","resolution":{"observed_at":"2026-08-15T14:33:56.835665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.840426Z","title":"Crafting Papers on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.840426Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:fc8061773ce7bb243e61c63feebbd279ed74d0588ef3bf9096d170aa6c7fa5a6","observation_id":"c3fb7bf6-617c-4351-a0d7-04318b68b08c","resolution":{"observed_at":"2026-08-15T14:33:56.840426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.845192Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.845192Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:80b1297ae16f8258ee11d96f787a492c448c08cd9757cb95214f054d1a437d15","observation_id":"13586f06-ca81-432d-8109-8a921696b338","resolution":{"observed_at":"2026-08-15T14:33:56.845192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.849548Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.849548Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:d1f02d9b5548f204d4ae30a2c6a3a6b7e25649bb4e5948a7179dc730341b5784","observation_id":"133f46fa-b49d-4f50-8661-ea6cd2b914b1","resolution":{"observed_at":"2026-08-15T14:33:56.849548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.854015Z","title":"I , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.854015Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:e6b8256bb9a36b2ca8f4a22d991bbdbf35c93fff53d25a57eb22963b0d4bd6f3","observation_id":"9725683b-da24-411f-adda-270c3772baf0","resolution":{"observed_at":"2026-08-15T14:33:56.854015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.859504Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.859504Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:1b81d64d5e7baa2b69e14e618e0e3dab457197cdfaf33d758d7951dc980dab80","observation_id":"3608e0a3-59c6-459d-90cf-1f6f97131bd9","resolution":{"observed_at":"2026-08-15T14:33:56.859504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.864054Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.864054Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:ad71b559a6a62a79186cc9a4c59b8131f7c9d515f482f97b64828bf042a9bbe1","observation_id":"a164cdb9-0fba-44ad-967b-1996a48c06e8","resolution":{"observed_at":"2026-08-15T14:33:56.864054Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.868465Z","title":"Newell and P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.868465Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:cbe224f4563001314886b1d903d26d42886f664d27c24a55475cbe0e6a61d078","observation_id":"ec7fe7f1-aeee-4450-9bad-a2e9fcb57610","resolution":{"observed_at":"2026-08-15T14:33:56.868465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.872829Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.872829Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:b4854b73b76c8b84d4fbbff437156e8774df49018ca9d9639f8ddaa153958513","observation_id":"47445272-8dd4-4d1a-8f89-584d8f2450f8","resolution":{"observed_at":"2026-08-15T14:33:56.872829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.877320Z","title":"On divergences and informations in statistics and information theory , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.877320Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:ace7358512c276a380ca8b653c66790bd4d6ee8608aa9026320eb8039e960fb3","observation_id":"22e67784-00d7-462f-b475-ab78ac4b01cb","resolution":{"observed_at":"2026-08-15T14:33:56.877320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.882133Z","title":"doi:10.57967/hf/0181 , publisher =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.882133Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:9ba107a09ba06f18f2ece4c31a650cc3875b796d14d5334273f76a03d41ed916","observation_id":"11ebb4b4-ad36-4f2e-8c7e-b8eec46f25ec","resolution":{"observed_at":"2026-08-15T14:33:56.882133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.887637Z","title":"Simple statistical gradient-following algorithms for connectionist reinforcement learning , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.887637Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:b0f11f1eebfa3e158e8b288615efc3d38fa5f9a0c3c4a15a84c457071b940966","observation_id":"dcd8613b-c205-4a7c-b2d9-30920badb89e","resolution":{"observed_at":"2026-08-15T14:33:56.887637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.892919Z","title":"f -divergences , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.892919Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:a129fab79e76d623c7f1d3bd86fd3d9de9afe388e721ba52b6923216b2841b14","observation_id":"1d7150da-7029-471f-9ab8-94039aa83bb7","resolution":{"observed_at":"2026-08-15T14:33:56.892919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.897264Z","title":"Convex analysis , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.897264Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:e09b6412b06b8df5a3bc22e6a35b35661d9f14670f918946fcdc452a1c6464fd","observation_id":"a44610d4-cdd0-4dd5-a47b-40a3926e721a","resolution":{"observed_at":"2026-08-15T14:33:56.897264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.901774Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.901774Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:0b23e5b96cbbae7d8e48dd6e0a2f87292e34d1277de41aee4dd190362713cfa3","observation_id":"6dfd3eb2-0445-4710-81e3-ddc75e361355","resolution":{"observed_at":"2026-08-15T14:33:56.901774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.906462Z","title":"Convex optimization , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.906462Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:dc4c10d962820215efb7e97a305772d05134589ef296c1ff92c1b3384b14d253","observation_id":"e07a24ba-d01c-4c36-bd77-a5047ea44ac4","resolution":{"observed_at":"2026-08-15T14:33:56.906462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.910999Z","title":"Convex analysis and minimization algorithms I: Fundamentals , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.910999Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:61c3c61433da33e0924a39bc5b6a0e66923a1706860982a0dc1221ea17d255f0","observation_id":"70a453ea-daed-4821-92b3-aabd6ce3414a","resolution":{"observed_at":"2026-08-15T14:33:56.910999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.915692Z","title":"Information theory and statistics: A tutorial , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.915692Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:511c81e664c7b9a1359c45efb852d5b16fa6350d6fb84e02c1af3178fb244688","observation_id":"73914b37-fabf-4f95-9d74-f6e1057c9b76","resolution":{"observed_at":"2026-08-15T14:33:56.915692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.920473Z","title":"Entity-level Factual Consistency of Abstractive Text Summarization , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.920473Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:6b4b84976814325c05aa116fc1a3fc374bbb549a1a7aba31b8f87e9d3f2e40bb","observation_id":"fc6638d6-7600-4191-9d5e-78ff94bbfe25","resolution":{"observed_at":"2026-08-15T14:33:56.920473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.925665Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.925665Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:5feeb3724f18755e789f9cfa78ed848583cbc9da9e6d2fb8e435cb30224e7640","observation_id":"8983a345-2c2a-402e-a1f7-bb8bff26921b","resolution":{"observed_at":"2026-08-15T14:33:56.925665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.930773Z","title":"A Distributional Approach to Controlled Text Generation , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.930773Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:3019a4a4750e4eafc1d25795b69250217043a9ed39003e2fc1ae38173ba04a0b","observation_id":"4ca715bd-1961-40e9-b363-252bcf824167","resolution":{"observed_at":"2026-08-15T14:33:56.930773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.935545Z","title":"f -divergence Inequalities , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.935545Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:4dd665f7857851a4088b9a6572722db2e265a807f5d2bcb318355dc8723fef9d","observation_id":"2ada9f43-48e6-4230-9486-f708cabd444d","resolution":{"observed_at":"2026-08-15T14:33:56.935545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.940134Z","title":"Neural Text Generation from Structured Data with Application to the Biography Domain , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.940134Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:bd5f13c3ab4fb3979ec42203d9be6c1cd56e17d16ce4c870a490851072ced207","observation_id":"9e65c88f-31e1-42e8-8e03-e10c025ce026","resolution":{"observed_at":"2026-08-15T14:33:56.940134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.944614Z","title":"Controlling Conditional Language Models without Catastrophic Forgetting , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.944614Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:0ac1bc16d3d1d3f6c4d05bebe4b9b4a6037ef54f263459ee5a88153078080e4a","observation_id":"8fba8887-8540-44d4-9242-c5b402b1085c","resolution":{"observed_at":"2026-08-15T14:33:56.944614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.949430Z","title":"On f-divergences: Integral representations, local behavior, and inequalities , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.949430Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:e4e2adf2b22ac34d3a66ef2e6d737ddae750af8a2bd43ca9802fa6ffe5cc755d","observation_id":"eb6ec6b5-8d69-485d-b95b-bb33af3f661f","resolution":{"observed_at":"2026-08-15T14:33:56.949430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.955238Z","title":"and Della Pietra, Stephen A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.955238Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:1620ae00cd392d035b510c73640f15e65b00e9d514f632d89c976335e19ee942","observation_id":"66500632-7ace-4fa9-8ba2-c43b7a3fa659","resolution":{"observed_at":"2026-08-15T14:33:56.955238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.961888Z","title":"Abstractive Text Summarization using Sequence-to-sequence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.961888Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:eaa1775321c3871c5186d412922e02588f8802eb35142bf328cc713ff6edec65","observation_id":"99d027bb-6cfb-4939-9678-84defc74eedf","resolution":{"observed_at":"2026-08-15T14:33:56.961888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.966741Z","title":"Variational Inference with Tail-adaptive f-Divergence , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.966741Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:4563b2b85593eb0a3a991ecf0aaa6d6122e04a9f4bcdb40ca3d038146db040d4","observation_id":"603b9ee9-fb85-4864-b3c2-dc8190b30522","resolution":{"observed_at":"2026-08-15T14:33:56.966741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.971646Z","title":"Transformers: State-of-the-Art Natural Language Processing , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.971646Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:5355650eee4d4057c1159105919c17a23f189ecc4c6298946365fe98c9cf5475","observation_id":"cf5d80f1-5906-4b5c-8170-314ec6446b1d","resolution":{"observed_at":"2026-08-15T14:33:56.971646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.977001Z","title":"Kingma and Jimmy Ba , bibsource =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.977001Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:876e51432bfe0c4069ff7debe3e234d4d36d4a6593fb4216bd7a746737fcabd7","observation_id":"6cd59760-014e-4013-ae40-108adc79d6fd","resolution":{"observed_at":"2026-08-15T14:33:56.977001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.981700Z","title":"Hierarchical Neural Story Generation , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.981700Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:f8f8b35d62dc35c904c404d94f6784d9146130d03e5e0179340576852c4b8ebc","observation_id":"80df0a53-8348-45cd-9fbe-42b5eb8c674c","resolution":{"observed_at":"2026-08-15T14:33:56.981700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.986825Z","title":"Courville and Yoshua Bengio , bibsource =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.986825Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:9526b4520f3e2fdeb32386a26967e3b93cc35209d79e6e13931acaa68d1a293e","observation_id":"1618b06e-e1ac-48ae-a4e6-b2b3f1a81c80","resolution":{"observed_at":"2026-08-15T14:33:56.986825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d17-1103","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:58.671180Z","title":"Reinforced Video Captioning with Entailment Rewards , url =","venue":null,"work_id":"e94cb6cb-90b4-4b66-94af-8d93587f087a","year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.991526Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:6c976dc47d7f29ad49c624c989075211217698dc35de3196a54e06c8f04dc3cb","observation_id":"14272aab-278f-4891-bed9-604ade5b16e3","resolution":{"observed_at":"2026-08-15T14:33:58.676702Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:56.996295Z","title":"Martin and Animesh Mehta and Brent Harrison and Mark O","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:56.996295Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:97915debc8f737f81bbcffd7623fd174847f3c4eb7be706f2b833d7b3afad625","observation_id":"eeaa4754-cf5f-4569-b9b4-df93ea0ff529","resolution":{"observed_at":"2026-08-15T14:33:56.996295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.001104Z","title":"Deep Reinforcement Learning for Dialogue Generation , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.001104Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:6e7954d3cd8d4ca1e8ef319713e588d33041e1436422bc3e3bb908a483355d7d","observation_id":"e6de71c6-17ad-4c20-89a8-d350c81a0159","resolution":{"observed_at":"2026-08-15T14:33:57.001104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.006306Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.006306Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:d39fc7829476fc4dfc9fcf65ef7181ee7f2fa748ea17d8026d2c48a2bba726a9","observation_id":"e0a22e36-0ccc-4ac1-9d23-80dfbd87db62","resolution":{"observed_at":"2026-08-15T14:33:57.006306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.011934Z","title":"The 22nd international conference on artificial intelligence and statistics , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.011934Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:5be5c260bf09103b0939e41f2035026929fedd1cd37ded09b83fb757d5d480c8","observation_id":"8a37dd86-a5c6-4c04-baee-4a8d340099d1","resolution":{"observed_at":"2026-08-15T14:33:57.011934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.016719Z","title":"Proceedings of the eighth ACM SIGKDD international conference on Knowledge discovery and data mining , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.016719Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:b51c317376a5e51ae5fa2037244003049caf7b0a8fb67b67f29eef10cd30ee84","observation_id":"795db5b7-8a60-445c-a8b8-e2eea2430f00","resolution":{"observed_at":"2026-08-15T14:33:57.016719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.021187Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.021187Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:60dc3a5f0cd1a3e72ecc4b3fb90292d2aa41ae1e5171425718f307064a73479b","observation_id":"08af63a5-afd3-4df9-929e-a5a1a58285a7","resolution":{"observed_at":"2026-08-15T14:33:57.021187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.025622Z","title":"Probabilistic model for code with decision trees , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.025622Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:9aec2d50620098e733981a3f5e42b40ab8c9e2b252c3ecb8076903c70e58cb68","observation_id":"f4d1b4f3-44fe-43d4-8591-9d5c5178ff37","resolution":{"observed_at":"2026-08-15T14:33:57.025622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.030193Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.030193Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:825cf3ba9f2909be0240c6df04a1e1b95cb2f78581f19f8a5b8814a9eee66c7d","observation_id":"333c779c-0e91-42da-8d16-e4203a3d7c78","resolution":{"observed_at":"2026-08-15T14:33:57.030193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.035472Z","title":"The Woman Worked as a Babysitter: On Biases in Language Generation , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.035472Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:060c00dc34e7aab386c63c1488eedd5da6f1b586fd35fc039df47eff6338c48e","observation_id":"886d4348-b592-438e-83b1-3b0d9d7d65b0","resolution":{"observed_at":"2026-08-15T14:33:57.035472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.040366Z","title":"On Reinforcement Learning and Distribution Matching for Fine-Tuning Language Models with no Catastrophic Forgetting , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.040366Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:bde3aa7d3c76b9fc7462f027ee55024d273df2376c1b33980a5337c4b7cb9a6a","observation_id":"77d41182-0132-48d8-b0f8-f9e096566577","resolution":{"observed_at":"2026-08-15T14:33:57.040366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.044750Z","title":"and Daly, Raymond E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.044750Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:f218b9ebc406af5c28cfde9f776bfe5c39c5398727feaad30870b2a4c18d3a42","observation_id":"c59686d4-492c-4e00-a68d-64db87a13d28","resolution":{"observed_at":"2026-08-15T14:33:57.044750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.049239Z","title":"A Diversity-Promoting Objective Function for Neural Conversation Models , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.049239Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:0f7523158abaf1f1cff64d0540f15b5c057ef114192a53c3e82b918c3f15b7d6","observation_id":"515bfea2-c573-4a9d-b4dd-47fa65f60e5f","resolution":{"observed_at":"2026-08-15T14:33:57.049239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.054203Z","title":"Texygen:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.054203Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:b119b14ccf819a6e966b63b1dabfaf916f49efd8368f96d08e919a5524aa2c25","observation_id":"0097746b-eb61-4127-9a7d-5b600d90a76a","resolution":{"observed_at":"2026-08-15T14:33:57.054203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.058932Z","title":"Language models are unsupervised multitask learners , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.058932Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:d82c35bfd4edb8c3e79ae91e2e4b48b17499baea833f3f60ddfd55fc296a18bc","observation_id":"377d0c24-1af0-48c5-9d36-ce216aacb8bc","resolution":{"observed_at":"2026-08-15T14:33:57.058932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.063622Z","title":"Fine-tuning language models from human preferences , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.063622Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:1275f3e6c56b415ab8e2ecd131f51ce0549326f758b50c90d11b13d40919dc91","observation_id":"e133c8c4-05ff-4a2f-8e70-5e3ee4cebae2","resolution":{"observed_at":"2026-08-15T14:33:57.063622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.068199Z","title":"A tutorial on energy-based learning , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.068199Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:81476264aee6c1b0c3fb4edc3adcb9b10ed3a72069404b0c79eb1d03bc3494f4","observation_id":"7b3eb115-6dc7-4076-ab9c-af3e90efe1ef","resolution":{"observed_at":"2026-08-15T14:33:57.068199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.072749Z","title":"Infinite-horizon policy-gradient estimation , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.072749Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:da41c906e9192d1031a410e36fbb932946e768fd2e13a9b7cb2ffd773e361b31","observation_id":"d9ac53cb-1d7b-4373-bc8b-23b18acc9d09","resolution":{"observed_at":"2026-08-15T14:33:57.072749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.077661Z","title":"Training products of experts by minimizing contrastive divergence , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.077661Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:03d467e37aa090aaac78539eea902f571f0a7ae60340fd2d72e8e21038ef30b0","observation_id":"f71c6baa-4521-4a2b-b438-6766908931be","resolution":{"observed_at":"2026-08-15T14:33:57.077661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.082525Z","title":"Global Autoregressive Models for Data-Efficient Sequence Learning , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.082525Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:fe213dc9682c5beacfcde3389a8e6e86ed48c9502d86a519d3b9f6e505f7c69c","observation_id":"31319ff9-598f-4265-b608-53e7e517caf1","resolution":{"observed_at":"2026-08-15T14:33:57.082525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.087122Z","title":"Distributional reinforcement learning for energy-based sequential models , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.087122Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:9772a0a1bdf977ee86205e35a733715f6b03afbbf8255d94ab00b9abd22e129c","observation_id":"cdd30e56-690e-451e-9f59-4f7d83b5bbfa","resolution":{"observed_at":"2026-08-15T14:33:57.087122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-15T14:33:57.091820Z","title":"Riedmiller , bibsource =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.091820Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:f01c06e41bc0cc76487fb688d7df896f99aff11ca959488d002ecfd596e81154","observation_id":"eb4ed9cf-7b0a-4607-801e-28ac78ec5b19","resolution":{"observed_at":"2026-08-15T14:33:57.091820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.096994Z","title":"Jordan and Pieter Abbeel , bibsource =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.096994Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:11227c07112b894787361da1d78b0b9c7c98379f095ea1f425baf426b5024932","observation_id":"c40c249d-cfcb-46f2-a26b-7b2a0e6cbb81","resolution":{"observed_at":"2026-08-15T14:33:57.096994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.101378Z","title":"Proximal policy optimization algorithms , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.101378Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:a923a3f2b55624d75b778b85181523c5d6a7f3464b1a182faccb6c293ff1ce7a","observation_id":"1291f08b-1d02-4198-82be-ff4d2e265bd0","resolution":{"observed_at":"2026-08-15T14:33:57.101378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.106144Z","title":"Tuning recurrent neural networks with re-inforcement learning , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.106144Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:8d9d49cf03498eba266b6f3e0e0e67c42a803ee1a58dd6ab8b67b120d4b05069","observation_id":"4dc043b5-aa07-427b-9035-45c680e84baa","resolution":{"observed_at":"2026-08-15T14:33:57.106144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.110689Z","title":"COLD decoding: Energy-based constrained text generation with langevin dynamics , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.110689Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:7cf7caacaae91bcfa98b4ac9193236dbce2092868f9abe2e6aaec19f7279bd5b","observation_id":"2653d197-cdc4-4909-bc17-f92f2dc3a9fe","resolution":{"observed_at":"2026-08-15T14:33:57.110689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.115452Z","title":"An Explanation of In-context Learning as Implicit Bayesian Inference , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.115452Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:e4997386669e40c1252f98cf72bfaef28b408e6a1324755a448aaecc3d155649","observation_id":"52cfd967-72cf-4d9d-8f9c-5e7ad3e63526","resolution":{"observed_at":"2026-08-15T14:33:57.115452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.119906Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.119906Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:f61c2b413ca403b44ff5a236ef4fd1acb0191945a8feae05e3cdec38707cad36","observation_id":"04723fb0-6279-4275-9378-4a4ebf0c23c5","resolution":{"observed_at":"2026-08-15T14:33:57.119906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11275","last_updated":"2022-10-21T10:24:00Z","snapshot_observed_at":"2026-08-14T00:54:57.734753Z","submitted_at":"2022-05-23T12:47:13Z","title":"RL with KL penalties is better viewed as Bayesian inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11275","snapshot_observed_at":"2026-08-15T14:33:57.124460Z","title":"Buckley , bibsource =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.124460Z"},"links":{"cited_paper":"/paper/2205.11275","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:0fa6e555b07dc0b35225f571164099a78d81a62fdf46b4cca532545c19afb62a","observation_id":"8ba7f66a-6485-4d5e-a4f5-ce4d07460d7d","resolution":{"observed_at":"2026-08-15T14:33:57.124460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.129118Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.129118Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:2468fd743b3bf358f54c486b324b8fd735ca9eedd9a7b5968a602a8ac1df34b4","observation_id":"46324ddc-457d-4a94-a6cb-c08b3c1545cd","resolution":{"observed_at":"2026-08-15T14:33:57.129118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.133644Z","title":"and Lowe, Ryan and Voss, Chelsea and Radford, Alec and Amodei, Dario and Christiano, Paul , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.133644Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:2a9d9d6fc93986bf2595221c1198593f9410136671e77f25a9627a27363ef52a","observation_id":"274a8131-8ca5-4873-97d8-a5f851c1341c","resolution":{"observed_at":"2026-08-15T14:33:57.133644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.138244Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.138244Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:603861acef27949cbe48e9d792cbcdd33d257bc8c26ca3c76282d078b663aec1","observation_id":"5cd98524-5651-4f5c-b20e-0470ba91a435","resolution":{"observed_at":"2026-08-15T14:33:57.138244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.142652Z","title":"Teaching language models to support answers with verified quotes , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.142652Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:7f5c050defce81a8f7af401c1373d9f4b7d75bdbff67c5931f8226fa2ad517c8","observation_id":"ed0213e2-728b-45f2-9c6f-feb18546326d","resolution":{"observed_at":"2026-08-15T14:33:57.142652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-08-16T09:29:21.586810Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-15T14:33:57.147232Z","title":"Improving alignment of dialogue agents via targeted human judgements , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.147232Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:f692661e96dc979f6ad68d392e51d26b5bcec9d65ff0bc397f0c0d07fc8f6c2e","observation_id":"447b022d-ebf1-447f-b9d0-67d9c007791d","resolution":{"observed_at":"2026-08-15T14:33:57.147232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.152934Z","title":"Language model cascades , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.152934Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:50a97c6fd5c1d0e40f96a183be1ba18cb12e9136c7875a91d4b59f02c1b79591","observation_id":"c6750c18-9717-4cd6-9017-2a56ab5ee40f","resolution":{"observed_at":"2026-08-15T14:33:57.152934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.157481Z","title":"ArXiv preprint , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.157481Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:19f8165b398bda6dad9ab747b73f6e1c8e85ee8d56d8ad726e990b68da74928a","observation_id":"2346ffb3-ea28-4385-98e3-fc4183a5562f","resolution":{"observed_at":"2026-08-15T14:33:57.157481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.162101Z","title":"Mescheder and Andreas Geiger and Sebastian Nowozin , bibsource =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.162101Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:fdfdbbf4cc8aa0a6908ded1d497f8c27644a498b440ec742e8b6f9badcf1a5b1","observation_id":"a6b5686a-6d7d-441f-b384-af4db57aa04d","resolution":{"observed_at":"2026-08-15T14:33:57.162101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.166653Z","title":"Generative Adversarial Networks , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.166653Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:bcbb3eb1c39e81bc80ee6479b2f0074840974c3078dec678046b3f3b14573ddb","observation_id":"46a11b83-bb53-4823-a71a-3129f3a874fc","resolution":{"observed_at":"2026-08-15T14:33:57.166653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.171515Z","title":"Mode Regularized Generative Adversarial Networks , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.171515Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:80d08e233edd5e12b03e80526e8b46f1db94ab6413905a94b510e50af78fc9b8","observation_id":"17ab093b-166c-4c7c-aa84-28534fd699ad","resolution":{"observed_at":"2026-08-15T14:33:57.171515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.176045Z","title":"f-GAN: Training Generative Neural Samplers using Variational Divergence Minimization , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.176045Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:f2c25624fa3f27574309d678fdc017b6ff3249e53ff73417f6084b75122153d0","observation_id":"9ae8c800-8c61-413d-b077-603d2ea29f17","resolution":{"observed_at":"2026-08-15T14:33:57.176045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.180704Z","title":"Wasserstein Generative Adversarial Networks , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.180704Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:10fd12f42ebcbc7b0f76ebcd38ee33bece2156f8c8ec9c78d8668a90575fb2b1","observation_id":"2abc691a-e1cb-468f-9642-7471a6c57d6f","resolution":{"observed_at":"2026-08-15T14:33:57.180704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.185254Z","title":"How (not) to Train your Generative Model: Scheduled Sampling, Likelihood, Adversary? , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.185254Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:4c0ddc32849d61c43995aae1b551697251068664dc5413fa56067aab2d7c4383","observation_id":"ee9f2732-8899-4638-ad1c-7c7baa33d817","resolution":{"observed_at":"2026-08-15T14:33:57.185254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.189823Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.189823Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:8929056e0f68df6ac4b423399333050fca8fecd9346dba6565fb3ccac439fcf6","observation_id":"5f5c4e90-65cf-45b6-81e3-d0b0737cc5ed","resolution":{"observed_at":"2026-08-15T14:33:57.189823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.194390Z","title":"Scaling instruction-finetuned language models , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.194390Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:874c88c80f5b67f88422f5384b885186acc3b4533c585f155ca5c3d82583efd8","observation_id":"0e94129f-2d09-40c1-91d3-ea56dabd76a8","resolution":{"observed_at":"2026-08-15T14:33:57.194390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.198820Z","title":"Self-critiquing models for assisting human evaluators , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.198820Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:daad0151b1cd74813214dffae4e3e0b8a06f62ccf1ac931bc09fe589812100f5","observation_id":"03b6dee3-3398-4b43-95a2-2fa4c56abcd5","resolution":{"observed_at":"2026-08-15T14:33:57.198820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.203293Z","title":"Process for Adapting Language Models to Society (PALMS) with Values-Targeted Datasets , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.203293Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:07740090bbe854d171d576cf9f486a92b9018d9483100eb3fe4c4824629491d9","observation_id":"38726201-e607-4654-9095-5e6a2b22fac3","resolution":{"observed_at":"2026-08-15T14:33:57.203293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.207858Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.207858Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:3f1e34703ac0a3df19a1fae0bfebb44bd166b80989665f88fc0e833a1aae3dc3","observation_id":"0e9db845-e824-4967-8fc2-09e2cf427a21","resolution":{"observed_at":"2026-08-15T14:33:57.207858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.212359Z","title":"Challenges in Detoxifying Language Models , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.212359Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:5846df4c3dcb631cb2a2aaad7084d430d7cae33236667eec8c7a5a6bf611eb0a","observation_id":"901ed4b7-d47d-4fd5-88e2-1d332da4f728","resolution":{"observed_at":"2026-08-15T14:33:57.212359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.216973Z","title":"ArXiv preprint , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.216973Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:a40c12121149556d73aa72dbc8a72e9a96f3511615eec7c1f23fd80920387966","observation_id":"7938579b-100d-469d-8f68-19d8bfe62f8b","resolution":{"observed_at":"2026-08-15T14:33:57.216973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.221522Z","title":"ArXiv preprint , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.221522Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:c3f851e975eafb825ce4384ef8ff56ceb2a24d4fd698f99f0441bbb07243cb4a","observation_id":"fe9522e8-4ed0-4987-bae7-a27481bd400f","resolution":{"observed_at":"2026-08-15T14:33:57.221522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.226150Z","title":"Owen , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.226150Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:8c2f9ae56003e09989c9f6283cf342088236ba8e77c622a1bbaa798da332e765","observation_id":"9bfc43a6-2d05-458a-9ad5-40448b103c7e","resolution":{"observed_at":"2026-08-15T14:33:57.226150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:33:57.230753Z","title":"Recipes for Building an Open-Domain Chatbot , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-15T14:33:57.230753Z"},"links":{"citing_paper":"/paper/2608.07419"},"observation_digest":"sha256:4823fc39e95c81a807baabf70df1c95a461ebeb36db27d41038eee47357998c1","observation_id":"2001f8b8-6601-4cbe-85b0-7c7cbac4970c","resolution":{"observed_at":"2026-08-15T14:33:57.230753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07419","last_updated":"2026-08-07T17:05:10Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T09:30:06.106701Z","submitted_at":"2026-08-07T17:05:10Z","title":"Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":98,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 0 inbound Pith citation observations for arXiv:2608.07419."}