{"as_of":"2026-08-10T01:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3025ebb37154867289e7891b5e29d10412f5b75a9ef5db82be1dcbc1a176e6fa","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:47:21.920389Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07035/citation-record","integrity":"/paper/2506.07035/integrity","json":"/paper/2506.07035/citation-record.json","paper":"/paper/2506.07035"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:21.392741Z","title":"Guiding generative pro- tein language models with reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.392741Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:31259bba24914f39f87428a3d07519c5d7d3013684ff324ac11dbc017236620d","observation_id":"e230158e-d9f8-474f-9577-93182e6e412c","resolution":{"observed_at":"2026-08-07T05:47:21.392741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:22.875503Z","title":"Saprot: Protein language modeling with structure-aware vocabulary","venue":null,"work_id":"be483c4a-cd84-481c-a2bb-50838257fe3a","year":2023},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.461837Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:6b1690bfbaf988b6f1d45777494ccb22a5f0df5cec6946ca98796bdaef916ea5","observation_id":"17e3a6be-1575-4161-b0aa-d1fc6e42461b","resolution":{"observed_at":"2026-08-07T05:47:23.037812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:22.624313Z","title":"Aligning protein generative models with experimental fitness via direct preference optimization","venue":null,"work_id":"db78b779-0566-46c0-b7d2-c1773f5ddd08","year":2024},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.517211Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:a6f246de5cd0826b465bdd371aa488c1f0ee3a97aa453dff924106a6a8580f42","observation_id":"0cce96fb-6f87-44c8-bf1b-47cabfec4727","resolution":{"observed_at":"2026-08-07T05:47:22.737356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10719","last_updated":"2024-10-10T08:30:17Z","snapshot_observed_at":"2026-07-06T18:01:05.698046Z","submitted_at":"2024-04-16T16:51:53Z","title":"Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10719","snapshot_observed_at":"2026-08-07T05:47:21.619389Z","title":"Is dpo superior to ppo for llm alignment? a comprehensive study","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.619389Z"},"links":{"cited_paper":"/paper/2404.10719","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:bd02e1424778581b908beec32038796c9cdac21b14aaf21d7c4c86471c0d9601","observation_id":"43348961-396d-47d9-b7bd-1a31a60c7432","resolution":{"observed_at":"2026-08-07T05:47:21.619389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-09T04:25:12.977504Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-07T05:47:21.717895Z","title":"Rrhf: Rank responses to align language mod- els with human feedback without tears","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.717895Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:0cbb17be8be1b3ae30586d5ee302fc81b11a32b70e2b8dbad010649f8697d937","observation_id":"eb4a2363-412a-44da-98fa-a8a3cae7000a","resolution":{"observed_at":"2026-08-07T05:47:21.717895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11147","last_updated":"2022-06-03T16:31:08Z","snapshot_observed_at":"2026-08-09T05:14:29.791440Z","submitted_at":"2022-01-23T14:49:49Z","title":"OntoProtein: Protein Pretraining With Gene Ontology Embedding","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11147","snapshot_observed_at":"2026-08-07T05:47:21.783284Z","title":"Ontoprotein: Pro- tein pretraining with gene ontology embedding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.783284Z"},"links":{"cited_paper":"/paper/2201.11147","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:1a88a8c5f8a8674c393e6a7879fcdb63b1d9f2b7f5c91e0b1433a5c32315a830","observation_id":"d06950e3-aa5f-4e06-87ce-3bb124a3dfb5","resolution":{"observed_at":"2026-08-07T05:47:21.783284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:22.488282Z","title":"Decoding the molecular language of proteins with evolla","venue":null,"work_id":"eee17376-2e49-45c4-8c1e-7faa389dcbf8","year":2025},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.850473Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:4e3dd84bb590237d9243cfd5069cf0bc3dbd8f999536122ff10da02b49206471","observation_id":"83c208dc-075b-4955-9cfb-625fdae660a2","resolution":{"observed_at":"2026-08-07T05:47:22.526889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T05:47:21.920389Z","title":"M., Stiennon, N., Wu, J., Brown, T","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.920389Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:de5c3d9ce4b2378fbd68dd9d8344e96933ce98ea788c1bb5b69183a21692f4fd","observation_id":"6d074d5a-0045-44fa-9da1-ca76a3a4ef20","resolution":{"observed_at":"2026-08-07T05:47:21.920389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T05:47:20.296473Z","title":"Training a helpful and harmless assistant with rein- forcement learning from human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.296473Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:1efbce42c4eb64d44f2849a76d96437a8cef645f83375cb2497007d712e7318d","observation_id":"a7fc07ef-37c0-4ecf-8406-ac0e3d9eb7b0","resolution":{"observed_at":"2026-08-07T05:47:20.296473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-07T05:47:20.522484Z","title":"Improving alignment of dialogue agents via targeted human judgements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.522484Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:f0c38adcc83e601175bcb9f05051e40c81ca7bb2fe742d3bbdb5c3fefa34f891","observation_id":"95abaa59-ef2e-489d-afe8-9d151204e6df","resolution":{"observed_at":"2026-08-07T05:47:20.522484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-07T05:47:20.398463Z","title":"Raft: Re- ward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.398463Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:3f912896b3ff7bd500e54524237a33e9b8b787180f8e9af933bc32635d72a158","observation_id":"998e4fe7-f916-4953-b0e4-569012ae9acb","resolution":{"observed_at":"2026-08-07T05:47:20.398463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-02T06:08:09.777151Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-07T05:47:21.311124Z","title":"Re- warding progress: Scaling automated process verifiers for llm reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.311124Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:f14630797bedbfdee2e6f0b11934d1d20cadbd6530cac2762de5d954be57bedd","observation_id":"980cfff8-9240-45bc-91ff-15cf896c17c1","resolution":{"observed_at":"2026-08-07T05:47:21.311124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:23.215061Z","title":"and Consortium, U","venue":null,"work_id":"85ff23f7-517f-4919-8794-439fce5bb83c","year":2011},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.149795Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:76a66af1dbe94032ab5871e6c181c4cee49cf9c1d089ca4ec4d794f5b242047a","observation_id":"acd71fa8-76be-4dc6-b46e-5717aec335d6","resolution":{"observed_at":"2026-08-07T05:47:23.363316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T05:47:21.248673Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.248673Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:55782e0a009bd0225455901ef382dc58b05fa71c0288efeac1cd639583f4851d","observation_id":"b576ddf5-c069-4db5-b88c-d3126faa2b27","resolution":{"observed_at":"2026-08-07T05:47:21.248673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10963","last_updated":"2024-06-25T03:14:10Z","snapshot_observed_at":"2026-08-05T17:51:38.668510Z","submitted_at":"2024-02-13T20:16:29Z","title":"GLoRe: When, Where, and How to Improve LLM Reasoning via Global and Local Refinements","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10963","snapshot_observed_at":"2026-08-07T05:47:20.679825Z","title":"Glore: When, where, and how to improve llm reason- ing via global and local refinements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.679825Z"},"links":{"cited_paper":"/paper/2402.10963","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:997ab2f2abc9b9163b1639343884cffc68c099d8baec8a3301e8b7bd66c1874c","observation_id":"b44131e8-95ac-4c9b-991f-64554fd390d4","resolution":{"observed_at":"2026-08-07T05:47:20.679825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15007","last_updated":"2025-01-25T00:59:12Z","snapshot_observed_at":"2026-08-07T22:22:36.153221Z","submitted_at":"2025-01-25T00:59:12Z","title":"Controllable Protein Sequence Generation with LLM Preference Optimization","version":1},"cited_work":{"arxiv_id":"2501.15007","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15007","snapshot_observed_at":"2026-08-07T05:47:22.262029Z","title":"Controllable Protein Sequence Generation with LLM Preference Optimization","venue":"cs.AI","work_id":"396a9fce-7055-4083-8d44-2fd5735653af","year":2025},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.987776Z"},"links":{"cited_paper":"/paper/2501.15007","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:3dad4e352b34e8c5d41363108565c99241debc68c4621bebe9fe79711b4966e6","observation_id":"94071797-2ba7-4f93-af11-be65da36226d","resolution":{"observed_at":"2026-08-07T05:47:22.322892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10584","last_updated":"2024-02-25T19:15:26Z","snapshot_observed_at":"2026-07-06T17:04:09.326801Z","submitted_at":"2023-12-17T02:14:15Z","title":"Policy Optimization in RLHF: The Impact of Out-of-preference Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10584","snapshot_observed_at":"2026-08-07T05:47:20.823057Z","title":"Policy optimization in rlhf: The impact of out-of-preference data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.823057Z"},"links":{"cited_paper":"/paper/2312.10584","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:5f2e5ad266973ed84c52003d8d9ef6ec712eacb3a16b45a2e49cfa95f96d2ecb","observation_id":"cbcaa8fe-2360-4a59-8d31-ee40a228821a","resolution":{"observed_at":"2026-08-07T05:47:20.823057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03497","last_updated":"2020-03-08T04:27:16Z","snapshot_observed_at":"2026-07-06T09:10:40.408664Z","submitted_at":"2020-03-08T04:27:16Z","title":"ProGen: Language Modeling for Protein Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03497","snapshot_observed_at":"2026-08-07T05:47:21.080984Z","title":"S., Anand, N., Eguchi, R","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.080984Z"},"links":{"cited_paper":"/paper/2004.03497","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:93eee655e4ce3b81afb020f9c3bdb1c13ddbd08a64970da0e73a902b2f6e8af8","observation_id":"d4301f0d-e67f-4db0-bc1f-60f5b22cdf68","resolution":{"observed_at":"2026-08-07T05:47:21.080984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","latest_version":1,"primary_category":"q-bio.BM","snapshot_observed_at":"2026-08-09T04:26:33.432873Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2506.07035."}