{"as_of":"2026-08-10T02:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb10e044b7f2294f68718cfbc3e544850ec44a6a03e651b779199e8c57a63ef6","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:59:56.975960Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09506/citation-record","integrity":"/paper/2507.09506/integrity","json":"/paper/2507.09506/citation-record.json","paper":"/paper/2507.09506"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-06T17:59:52.895636Z","title":"Hewett, Jamie Huynh, Mojan Javaheripi, Xin Jin, Piero Kauffmann, Nikos Karampatziakis, Dongwoo Kim, Mahoud Khademi, Lev Kurilenko, James R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:52.895636Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:79d835a4ca053b159b599ddf230200b5485d532f0bf8f72e2bbc0ef95f23806b","observation_id":"bb077e7a-11ba-4a27-acdf-cd29efcc3df6","resolution":{"observed_at":"2026-08-06T17:59:52.895636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.716230Z","title":null,"venue":null,"work_id":"6cbba188-3176-44d4-9262-58e530eb4e18","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:52.960245Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:5c6e53dcc90f59768e2a3f225c676e5d5d1b3af587a7e45e6a8e276e2aaf4808","observation_id":"8697caef-a484-4eab-818f-91812189f8f4","resolution":{"observed_at":"2026-08-06T18:00:00.768946Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.617353Z","title":null,"venue":null,"work_id":"ee5c401d-f2a7-4ad5-b9c5-1b101a23b57d","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.020821Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:1207ca876fb187cd5b824151ef59c852d19e9cd6fdd4821f8081386a0fa2e2d3","observation_id":"f73dd20a-2c8d-4640-99e2-6d0ec88420d7","resolution":{"observed_at":"2026-08-06T18:00:00.663910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.545243Z","title":null,"venue":null,"work_id":"e867fa48-301d-45fd-a273-1b5f7b64d747","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.178338Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:96beeaa214e7f496d24a0dcba2090f93ecc5ea26bb3bdb5e89229f78cfc51a9e","observation_id":"505c07f8-3a21-4cee-bbc3-2d0249389bea","resolution":{"observed_at":"2026-08-06T18:00:00.581449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.429636Z","title":null,"venue":null,"work_id":"2d3bbebb-acda-47a0-8bf0-f7553bff3486","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.296176Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:922f64f696e32f7ea43f263fa2793a87e1bdc28d07d2a21d59cc15b78fa5d5d8","observation_id":"8c678b6d-d86f-48b7-93b4-94e1db04af7a","resolution":{"observed_at":"2026-08-06T18:00:00.481780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.311347Z","title":null,"venue":null,"work_id":"a5f0d41a-3bf9-47fd-b57e-7b750e012f10","year":2021},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.402737Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:2f02fe22531b69e12acc7cc3b7eb8b6729684df400747a32e5f618092ab4acc9","observation_id":"c1d8474b-a273-4e66-b4e5-ee4eb8ca9464","resolution":{"observed_at":"2026-08-06T18:00:00.356532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:53.475072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.475072Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:f8ca7f07d09cf1ede55ab7b5eb449c54627d590b47486275acbdb5830f7ef700","observation_id":"2f659ed9-c18a-493e-ab87-d9716e803523","resolution":{"observed_at":"2026-08-06T17:59:53.475072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.187207Z","title":null,"venue":null,"work_id":"ca93226d-c1c6-47db-b1e4-0f9d5d3c0fed","year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.559851Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:9a7488140b3a754e269c9ebbd68390d67d9c5268732d3cca329c1b3bde97f16d","observation_id":"9c3ceed1-9dc9-456d-a587-cbd59b6eb83b","resolution":{"observed_at":"2026-08-06T18:00:00.260214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T17:59:53.672437Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.672437Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:99121f2b97b9fb7aa5df01ffcd7155865e4734db140c27e51c82c9411141f9e0","observation_id":"7a996289-a6cd-4e4b-a9c6-99a98f4a0113","resolution":{"observed_at":"2026-08-06T17:59:53.672437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-06T17:59:53.794460Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.794460Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:6dde5ee92274e44a3b93b8400bbf2d27dc81729231c24b438058427fef9e9f6a","observation_id":"69910955-fcaf-4f33-907e-d5b232f3ff13","resolution":{"observed_at":"2026-08-06T17:59:53.794460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:53.888152Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.888152Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:54981a5c6fa49e4d65ad2879ef922c4175cff42b084bd4f8c0b8c24655f508b2","observation_id":"aa538448-6204-4225-9771-94b04474a304","resolution":{"observed_at":"2026-08-06T17:59:53.888152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T17:59:53.957827Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.957827Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:e1503d1b2c749fef8ca8e3a8ef6b6d939435bafc5ff94bf88b05ba70306f4a7b","observation_id":"5c3f7c0d-3659-47bc-a905-6fd47f029ec0","resolution":{"observed_at":"2026-08-06T17:59:53.957827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.056087Z","title":null,"venue":null,"work_id":"b5aef60c-ab0e-499a-a6e9-bdfc8904eedd","year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.062411Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:4c83a936c81e61d9f0330492867aa62f50d3ebd334b7bda57eabade8c542d1fe","observation_id":"afe713a9-6687-41d2-bac4-f0744c85a1e5","resolution":{"observed_at":"2026-08-06T18:00:00.122762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.948020Z","title":null,"venue":null,"work_id":"2135352d-52fd-4bde-b977-9e2cfa5e8cac","year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.167070Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:54ee49b5bf6ceb72d0be2237e8f4487d420681fec8ab31df8aefb9e52c5a4585","observation_id":"7c4558a2-af67-4c96-8e31-1cf99533af0c","resolution":{"observed_at":"2026-08-06T17:59:59.997001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.814455Z","title":null,"venue":null,"work_id":"245cacbb-6654-4445-9f69-735e36444948","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.294447Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:a361a13ab4e99fddb1ab22238f0f774d6e23a4f338eb1b8a9c0719f850cb85db","observation_id":"1b123c7b-4cd0-4e72-9da5-efb4c9077882","resolution":{"observed_at":"2026-08-06T17:59:59.863451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.663747Z","title":null,"venue":null,"work_id":"488b759e-084f-4a30-abb4-ecd611fe811a","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.397668Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:d3d1c3303a9499610e8d77f1bafa1690c3533339500fd328841ad1bbdc588544","observation_id":"0f7f95c4-12e5-4f46-92d8-29c264908d4a","resolution":{"observed_at":"2026-08-06T17:59:59.724619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:54.507763Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.507763Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:43c1b001af99f04306a702a99a3ebfbab8355abc504c7adbd70e44a6426093d4","observation_id":"81ba88a6-195c-4baa-9f09-d603e53cd95b","resolution":{"observed_at":"2026-08-06T17:59:54.507763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.478486Z","title":null,"venue":null,"work_id":"efe34f71-b1fb-4163-89ae-13be7a1f0c34","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.617255Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:746e73116f2116f96d10d76fe0db89ddf488bdbc7b2c02b52e044eadde7065cc","observation_id":"504a3fd0-add1-4af8-aa86-546a6f68611e","resolution":{"observed_at":"2026-08-06T17:59:59.573324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.271761Z","title":null,"venue":null,"work_id":"d3f9e0a3-bd2f-49b6-af1c-214791c7816f","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.677719Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:8ce120a5e4e4897e870cd6cf3ef465c395ee015c499f9ca278ff52a807b824d3","observation_id":"91ab2477-3b1a-4cb3-b5a7-f579790fcb27","resolution":{"observed_at":"2026-08-06T17:59:59.369634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:54.787439Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.787439Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:118253698f3e295d635996d4d0efc152b99a7f634b086225507889252ff5d3c7","observation_id":"edacdb47-961b-4acb-b92a-38c408e86286","resolution":{"observed_at":"2026-08-06T17:59:54.787439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.109122Z","title":null,"venue":null,"work_id":"357cdc83-a204-4c22-ad7d-0c3f92bdb440","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.890129Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:12553d1295fae6f1a35a6d6ca69f6eb0a64aa17418c2e4473555851893b569c6","observation_id":"2479cf2b-cddf-4770-83c0-e9ae65995a31","resolution":{"observed_at":"2026-08-06T17:59:59.157748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:55.020695Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.020695Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:18c4bf537ecec9796d848acfc54458d0d9063b86a63bef40722400b538f03d39","observation_id":"0481e7c8-909c-43b2-b014-f5c165db5eef","resolution":{"observed_at":"2026-08-06T17:59:55.020695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.896080Z","title":null,"venue":null,"work_id":"49802bc2-2e1d-4347-a01d-3da52b49c30b","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.134838Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:76c3a32ccb1488f78068c536ef358ba84ae0765e21de4e5de7a634452b3730a3","observation_id":"2db68c4d-1840-452f-92a3-5d357cc53231","resolution":{"observed_at":"2026-08-06T17:59:58.999329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.744519Z","title":null,"venue":null,"work_id":"f9f0aaf3-f7c3-49b3-acaf-9a15f83d1210","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.225727Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:f5c521ac4ed3c1760d9a543dc0a0448489db826e3c766ee9998f51458e245dbe","observation_id":"e3c5325f-dfb2-488d-bbe2-253a90edfb16","resolution":{"observed_at":"2026-08-06T17:59:58.823847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.544372Z","title":"Needle threading: Can llms follow threads through near-million-scale haystacks? In The Thirteenth International Conference on Learning Representations","venue":null,"work_id":"e30b699f-366e-43e8-b049-7f1ce9ccaa92","year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.315523Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:42a7e2eb2cbc7362f6bd8688b8a5fd2ae2d163f735dc0cc1e98206222e6c5593","observation_id":"659102a9-322f-4d0b-90a9-2f51a1185a7d","resolution":{"observed_at":"2026-08-06T17:59:58.637960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11802","last_updated":"2024-12-24T01:41:28Z","snapshot_observed_at":"2026-08-10T01:47:41.207025Z","submitted_at":"2024-03-18T14:01:45Z","title":"Counting-Stars: A Multi-evidence, Position-aware, and Scalable Benchmark for Evaluating Long-Context Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11802","snapshot_observed_at":"2026-08-06T17:59:55.426052Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.426052Z"},"links":{"cited_paper":"/paper/2403.11802","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:6c6640326db473ee923d5b9ac0b71fed11e1d8259d282615453c504292f23751","observation_id":"12fa92ed-3aa3-45b5-b1e3-ed4622414560","resolution":{"observed_at":"2026-08-06T17:59:55.426052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02115","last_updated":"2024-10-04T12:52:28Z","snapshot_observed_at":"2026-08-03T23:47:53.992083Z","submitted_at":"2024-10-03T00:38:12Z","title":"L-CiteEval: Do Long-Context Models Truly Leverage Context for Responding?","version":2},"cited_work":{"arxiv_id":"2410.02115","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02115","snapshot_observed_at":"2026-08-06T17:59:57.085523Z","title":"L-CiteEval: Do Long-Context Models Truly Leverage Context for Responding?","venue":"cs.CL","work_id":"4b64234c-b372-4edf-841c-1286f63e52d3","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.558000Z"},"links":{"cited_paper":"/paper/2410.02115","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:e46b567a1743577618e04e88dbc316652ac5b94c066737f80e3c2b5c1b5b676e","observation_id":"39a49d4b-aa91-461f-94b1-4c3e695d7ca2","resolution":{"observed_at":"2026-08-06T17:59:57.182657Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:55.657882Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.657882Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:2017e322d8655f48222ef5a20ad06a14a4e5c6dd29f77409eaa53f6d37b00be7","observation_id":"c6f54c84-1da5-48ec-af54-94c90fbf58e1","resolution":{"observed_at":"2026-08-06T17:59:55.657882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12640","last_updated":"2024-09-20T00:47:33Z","snapshot_observed_at":"2026-07-06T19:18:04.618039Z","submitted_at":"2024-09-19T10:38:01Z","title":"Michelangelo: Long Context Evaluations Beyond Haystacks via Latent Structure Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12640","snapshot_observed_at":"2026-08-06T17:59:55.769028Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.769028Z"},"links":{"cited_paper":"/paper/2409.12640","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:5704a6c81f4725552b2b4fef46520b1b4952693426baf29da95c8bbd395a831a","observation_id":"dfd620be-4ca2-4fe0-a787-8604388a9465","resolution":{"observed_at":"2026-08-06T17:59:55.769028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:55.835525Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.835525Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:806da162881d6e03f3cdf6858f2a6c8c0e0d77c598595f42e3f7115822504de7","observation_id":"47515034-963f-4721-8dee-f051e8c6c1ff","resolution":{"observed_at":"2026-08-06T17:59:55.835525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:55.971322Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.971322Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:8030704d801b76f8aefba97cd1b6fdd08cc9b4ace96d78b295beced5ce94c756","observation_id":"8aa57f2b-9cfc-4225-9988-2045d2457b0a","resolution":{"observed_at":"2026-08-06T17:59:55.971322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.342297Z","title":null,"venue":null,"work_id":"f7ce2dcf-045f-4074-97bd-0688bf69072b","year":2025},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.044794Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:2eb53dafd94d01f5408da87860b06d324d34f497f016e45594d18f079520b066","observation_id":"7f340d44-47f5-44b6-b1d1-fba23f2eaaec","resolution":{"observed_at":"2026-08-06T17:59:58.438909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.169812Z","title":null,"venue":null,"work_id":"5cd7b25a-5f04-4099-9a2a-afbc8e5738f7","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.185711Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:bac749857d3b852ebfaab368f7e4a7688a4029e4c9bd72cbc32f4d09ca145f80","observation_id":"f7fa1a4b-f35c-4e67-aaa5-d810cfc42fed","resolution":{"observed_at":"2026-08-06T17:59:58.257412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02694","last_updated":"2025-03-06T18:41:54Z","snapshot_observed_at":"2026-08-06T10:41:12.245173Z","submitted_at":"2024-10-03T17:20:11Z","title":"HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02694","snapshot_observed_at":"2026-08-06T17:59:56.251833Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.251833Z"},"links":{"cited_paper":"/paper/2410.02694","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:7d32d3a8c9e74912c4220c4174a0a8e97728815099338544f75a01bafe5d2090","observation_id":"c53058d7-0c5f-4868-9881-57a94bea899b","resolution":{"observed_at":"2026-08-06T17:59:56.251833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:57.986370Z","title":null,"venue":null,"work_id":"db1003f4-de4a-4cd4-9958-6e4a7cbfe71b","year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.391825Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:35d3111fce1c14eef6100ed82ea9fade461a7c958319833b595798e851feda95","observation_id":"64f71471-6d7d-4c91-bb05-39264fa9a6f6","resolution":{"observed_at":"2026-08-06T17:59:58.081869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:57.785763Z","title":null,"venue":null,"work_id":"4c30ed17-749b-42bb-a89f-6471638ef8c5","year":2025},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.484329Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:ecd1d6a9d1b1ef37f61b903a4731d5e3bf775a2fb749fed5cd9b5a89cbc414b0","observation_id":"5ce3b21d-e3f6-4c63-bbe4-5d2b0090c863","resolution":{"observed_at":"2026-08-06T17:59:57.874288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02897","last_updated":"2024-09-10T07:43:19Z","snapshot_observed_at":"2026-07-06T19:10:29.880696Z","submitted_at":"2024-09-04T17:41:19Z","title":"LongCite: Enabling LLMs to Generate Fine-grained Citations in Long-context QA","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02897","snapshot_observed_at":"2026-08-06T17:59:56.569009Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.569009Z"},"links":{"cited_paper":"/paper/2409.02897","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:e5453f05dda7e2054fc6dc6da309d1236b1fb2af00301a3e63a07ae98759447d","observation_id":"24a99fe2-bc9f-463c-858d-ead932f7ab0c","resolution":{"observed_at":"2026-08-06T17:59:56.569009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:57.641315Z","title":null,"venue":null,"work_id":"1d4d3999-4d1c-40df-a141-6a89c768c3cf","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.652817Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:330c20f6eaf66192032d59b21598cadcf1a8fbeab50b9f80f4893277e43b05f7","observation_id":"939bbddd-0b0f-4f2e-a76e-e124788d940f","resolution":{"observed_at":"2026-08-06T17:59:57.716593Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:57.461627Z","title":null,"venue":null,"work_id":"d845bdfb-dcf9-450e-a33c-1af571f1b990","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.770202Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:834f9964ee264920221b8cc28cef7272e1aa15a12e4fe207970e756418db53be","observation_id":"76290f73-abc8-4e66-ad3b-cc1c33d60175","resolution":{"observed_at":"2026-08-06T17:59:57.547853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-06T17:59:56.813814Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.813814Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:bd7cc2752d58ff3557d41cb9ae2543046dc283558c14c85ef0163d2a8084f969","observation_id":"a8f80821-cfb5-4d70-a2c0-0b0c546757c4","resolution":{"observed_at":"2026-08-06T17:59:56.813814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:56.869075Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.869075Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:a93346cb99d5ad777835c3b5ec6c15f8216dc8e861ff0afed1b3c46bb685e5b7","observation_id":"99fbf921-423e-4723-ad57-4dde3ceab7e1","resolution":{"observed_at":"2026-08-06T17:59:56.869075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:56.975960Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.975960Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:3a38fbf5dbe21cf88818d5de195a0835e585036f26cf6c421df21c6907b38634","observation_id":"7e07e9f0-5a79-444d-8452-18fee2fefcb0","resolution":{"observed_at":"2026-08-06T17:59:56.975960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2507.09506."}