Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-07-30T22:39:33.984319Z
Paper Citation Record · LEDGER
As of 19 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2607.23425.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-07-30T22:39:33.984319Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
39 of 39 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 2bf794c6-2cc4-44f9-8adf-691d9ed5e9be · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 38443d65-f564-453f-b823-ee685066a0ff · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Program Synthesis with Large Language Models
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e411e123-eae2-4d26-930a-4173b930e941 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation ProofNet: Autoformalizing and Formally Proving Undergraduate-Level Mathematics
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bd39d6ba-689f-4315-96f7-f59e1155d553 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e3401297-49dd-409b-bb78-123807d5b176 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Thiruvathukal, Konstantin Läufer, and Mohammed Abuhamad
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation db462410-379a-4c5d-91ac-3cb864863064 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Thiruvathukal, Kon- stantin Läufer, and Mohammed Abuhamad
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ed2a9fd7-2cc6-4dcd-a329-7345f3798203 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Evaluating Large Language Models Trained on Code
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation acdcec03-f06a-49cf-a514-3299be05920d · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bdb9584f-19f4-4132-9767-ffef085d1632 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a06c515d-6c94-46f0-8091-738c0b124327 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3275aafb-6df0-4e2b-9265-9a58a739d9c8 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 29385bea-8c23-48e1-a8d9-466ea1a25fb8 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 85d7096d-cf91-4dd0-8b18-693823456a22 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation The Llama 3 Herd of Models
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 55191706-9ccf-43cd-9dfa-99eca598c70d · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Qwen2.5-Coder Technical Report
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f3724783-144c-4456-b0f5-0627582681bd · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dd8f4e5e-bcb0-4329-97a1-715761c8326a · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation SWE-bench: Can Language Models Resolve Real-World GitHub Issues?
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 628dae10-14ae-4181-96e7-7a3514012098 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3dbb8319-5a4e-4025-b9b4-a9591e7c5e25 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation 2002.Specifying Systems: The TLA+ Language and Tools for Hardware and Software Engineers
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d5023e13-2698-4813-8f12-8638849516cc · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7c0a8150-87f6-4687-bb49-766d6c50d18b · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Can LLMs Reason About Program Semantics? A Comprehensive Evaluation of LLMs on Formal Specification Inference
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d5732c5c-1f04-4850-ae29-5c652702d708 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Is Your Code Generated by ChatGPT Really Correct? Rigorous Evaluation of Large Language Models for Code Generation
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 59fafebc-5519-4ee2-916c-e17434186360 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b42a6cc6-5e2d-4810-b234-6efe78d93c65 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 08d7d937-b307-4c1e-a77b-be5513da35b7 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation DafnyBench: A Benchmark for Formal Software Verification
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d6f3ec60-7bb5-4dcb-879f-c41f0c76b000 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9672650d-2688-4aaf-9d83-f1b75308f379 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b5c639c2-4dcd-44bd-b74c-0e4670ba6fae · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ffb8bc5c-5013-4dfe-8042-d9db16fc59fd · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation VarBench: Robust Language Model Benchmarking Through Dynamic Variable Perturbation
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4e620310-b062-4f61-879e-2e73cdbba299 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation OpenClassGen: A Large-Scale Corpus of Real-World Python Classes for LLM Research
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8f1eccb1-b79d-4c30-83f7-f3e64ecd3c15 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Clover: Closed-Loop Verifiable Code Generation
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6c2bace3-6aae-4697-81a4-c168aa845406 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Autoformalization in the Era of Large Language Models: A Survey
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 98b79ae0-b66e-49a9-8663-674f3d908668 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation LiveBench: A Challenging, Contamination-Limited LLM Benchmark
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6e8bf887-cbac-41ef-982f-4335ba1b88f9 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Jiang, Wenda Li, Markus N
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 394cfa9c-71f9-4a7c-893a-721d7d99bd08 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Benchmark Data Contamination of Large Language Models: A Survey
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fe3afa99-3b4a-41e2-af35-71953c3da05a · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation LiveFMBench: Unveiling the Power and Limits of Agentic Workflows in Specification Generation
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4ba2b003-82ff-4631-b7c5-caeba2ec90a2 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation LeanDojo: Theorem Proving with Retrieval-Augmented Language Models
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3f9212f4-92aa-490a-a492-95e801fdf547 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Unresolved cited work
Reference 37
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 40289591-417c-4a50-aa07-395d7ed23850 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation A Careful Examination of Large Language Model Performance on Grade School Arithmetic
Reference 38
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9ac30b7d-918e-4f6f-a590-eda71cb5a2a2 · outbound
TLA+-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA Specification Generation Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
Reference 2024
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
No inbound Pith citation observations are available.