{"as_of":"2026-08-09T19:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca5e1077a3f06863c68465451af1fb63c130126364a98cf89f0c36e9875291bf","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:20:48.524542Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:02:40.051068Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07956","snapshot_observed_at":"2026-08-06T22:02:40.051068Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22853","last_updated":"2025-07-02T07:55:09Z","snapshot_observed_at":"2026-08-09T18:57:10.167031Z","submitted_at":"2025-06-28T11:28:04Z","title":"DICE-BENCH: Evaluating the Tool-Use Capabilities of Large Language Models in Multi-Round, Multi-Party Dialogues","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T22:02:40.051068Z"},"links":{"cited_paper":"/paper/2502.07956","citing_paper":"/paper/2506.22853"},"observation_digest":"sha256:8c806fe44cca4876e3c01de2fc3158cb3709ff3cd485880b606be69f488e7da6","observation_id":"2fa50049-4b1e-41f4-801b-d5d2a67165f4","resolution":{"observed_at":"2026-08-06T22:02:40.051068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07956","snapshot_observed_at":"2026-08-06T19:59:19.373313Z","title":"Bridging hci and ai research for the evalu- ation of conversational se assistants,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04043","last_updated":"2025-07-05T13:52:31Z","snapshot_observed_at":"2026-08-09T14:40:46.429673Z","submitted_at":"2025-07-05T13:52:31Z","title":"Evaluating the Effectiveness of Large Language Models in Solving Simple Programming Tasks: A User-Centered Study","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:19.373313Z"},"links":{"cited_paper":"/paper/2502.07956","citing_paper":"/paper/2507.04043"},"observation_digest":"sha256:7546f2cde910e2e93a7b5580f967f8f9447d59879b1211d383b868d6eb0c6e6b","observation_id":"a9d9e85b-fd2a-4583-b048-160051c28d7a","resolution":{"observed_at":"2026-08-06T19:59:19.373313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"cited_work":{"arxiv_id":"2502.07956","doi":"10.48550/arxiv.2502.07956","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07956","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ArXiv.org","work_id":"37fce10f-a047-4e16-8569-54dba9b82e73","year":2025},"citing_paper":{"arxiv_id":"2604.12998","last_updated":"2026-04-14T17:31:28Z","snapshot_observed_at":"2026-08-04T18:44:08.456348Z","submitted_at":"2026-04-14T17:31:28Z","title":"Personalizing LLM-Based Conversational Programming Assistants","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T14:33:15.633633Z"},"links":{"cited_paper":"/paper/2502.07956","citing_paper":"/paper/2604.12998"},"observation_digest":"sha256:a29f235448d2a0dc7ca981ae956dd07daa0e29a6fa65841a0699532c2d897981","observation_id":"8d3fe331-9068-4595-abd9-058aa98381d2","resolution":{"observed_at":"2026-05-10T14:35:32.042898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07956/citation-record","integrity":"/paper/2502.07956/integrity","json":"/paper/2502.07956/citation-record.json","paper":"/paper/2502.07956"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.446016Z","title":"Current and Future Bots in Software Development,","venue":null,"work_id":"f236430f-bc5d-49a1-a699-da3da2e8fa19","year":2019},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.347369Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:52ac9090c880b127ded8c105b37e9e51698d06691a31e39f229435c317456ef5","observation_id":"0acf1e46-57f1-48fa-ac7f-dc4a8cb30967","resolution":{"observed_at":"2026-08-08T11:20:50.450929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.432125Z","title":"Large Language Models for Software Engineering: A Systematic Literature Review,","venue":null,"work_id":"d6b92980-8de5-49fc-83b3-2abca01e178e","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.352132Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:a71dbadd3eb88cceac9824dc5ca2b46c28393e2d3b0af7ba54d3f2d2bd68fc8a","observation_id":"fee52c28-d20f-43a0-955c-2aced883580c","resolution":{"observed_at":"2026-08-08T11:20:50.436473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.416820Z","title":"Bots for pull requests: the good, the bad, and the promising,","venue":null,"work_id":"ccf8d7d8-50ce-4c26-9255-03cc1912e3af","year":2022},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.356446Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:6a2d19d9999cdb3aadf9913bf5fd2c171001d8049de2743c6fc96f6fee553789","observation_id":"aa231005-e6d7-4c13-91fa-dca5bee4b302","resolution":{"observed_at":"2026-08-08T11:20:50.421692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:48.360779Z","title":"Software Engineering and Foundation Models: Insights from Industry Blogs Using a Jury of Foundation Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.360779Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:3a269341e4f9007bbd0d2de6a9b1294a202e48ab8122a43ade023d3bda17430b","observation_id":"06a0d397-00de-4f6f-a3b7-a144ee72cf08","resolution":{"observed_at":"2026-08-08T11:20:48.360779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.402791Z","title":"Developer Experiences with a Contextualized AI Coding Assistant: Usability, Expectations, and Outcomes,","venue":null,"work_id":"21570016-c412-4a5a-8f14-6f082ba5c1dd","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.365987Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:d2e75be257f6b6e54cefe80968a552014781b9e42700b32919158d64d44cc977","observation_id":"5a6016ef-1a8a-4d1c-8d23-06cdd89002f9","resolution":{"observed_at":"2026-08-08T11:20:50.407237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.387828Z","title":"The Programmer’s Assistant: Conversational Interaction with a Large Language Model for Software Development,","venue":null,"work_id":"154e7743-ccd1-42c1-9bb3-226708c80ded","year":2023},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.370837Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:b5d9e3d8f0933dd3d0d224db1e66eb0d844a814009fbd1dc07a62e37aea248db","observation_id":"9b438722-fa06-49ad-9593-7ad670f44c0a","resolution":{"observed_at":"2026-08-08T11:20:50.392556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-08T11:20:48.376077Z","title":"Program Synthesis with Large Language Models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.376077Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:f755681aeaebe9135aad91e021b65793ebd745f2d29c355744785cf1f951fa17","observation_id":"e6233862-e741-4844-9f2e-c7b8977e7097","resolution":{"observed_at":"2026-08-08T11:20:48.376077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.372432Z","title":"How Far Are We? The Triumphs and Trials of Generative AI in Learning Software Engineering,","venue":null,"work_id":"d3085cc5-2e0a-4d73-80e6-df51a5aef1f2","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.380824Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:7a135aaac64a346160eb5caa3fddf2117c391f1067b99963e80a8c4ef1142a3a","observation_id":"ffae257b-f1f6-4b2d-8ea5-170b6d87331c","resolution":{"observed_at":"2026-08-08T11:20:50.377226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.357430Z","title":"How practitioners perceive the relevance of software engineering research,","venue":null,"work_id":"cf66abca-30bc-4b58-85e6-596474383430","year":2015},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.384931Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:06e6b8ddac97d30d6b4171a01dc683b3c7327cfe1d4075f59d1566791867c420","observation_id":"f6839ab3-cb5c-4224-b2eb-3c8843b58ca2","resolution":{"observed_at":"2026-08-08T11:20:50.362051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.342180Z","title":"Programmers Are Users Too: Human-Centered Methods for Improving Programming Tools,","venue":null,"work_id":"a9f35436-006c-456f-bb30-1b109b44b939","year":2016},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.389014Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:e2336bf7bf613c0361238cd5c47a3d3c70890e8688312319633365fe286f7be9","observation_id":"304fdf9d-414a-4593-b45d-81785c9357b5","resolution":{"observed_at":"2026-08-08T11:20:50.346999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.327570Z","title":"What’s (Not) Working in Programmer User Studies?","venue":null,"work_id":"99494a88-2b4e-4bbe-8f2d-e3b6708f9eb8","year":2023},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.393136Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:d98bbf97be6a311c065ad68f945e41256ea60b6caa30bfc857ae984fda5d6035","observation_id":"f9fbf88f-c446-45ef-9d89-6020ab793cfb","resolution":{"observed_at":"2026-08-08T11:20:50.332050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.312875Z","title":"Conversational Agents: Goals, Technologies, Vision and Challenges,","venue":null,"work_id":"60a7051e-bf0a-4a76-a740-ac7c787ff131","year":2021},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.397462Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:41454160af792f2260da67e34119101d883d0811e70dd3653488e212a0d974d6","observation_id":"036bd7f3-460d-4534-8604-0c5b570425fe","resolution":{"observed_at":"2026-08-08T11:20:50.317622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.298020Z","title":"Human-Centered Design Recommen- dations for LLM-as-a-judge,","venue":null,"work_id":"fe796db2-c643-4853-9236-92dbea7027c7","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.401865Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:99a8c66842455a77e5b08290b3cff6c868b84c283513e3d20e0135e888c9338c","observation_id":"5e1e36a1-be0c-4c4a-8493-f69e7e4d9dcb","resolution":{"observed_at":"2026-08-08T11:20:50.302949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.283339Z","title":"PromptMaker: Prompt-based Prototyping with Large Language Models,","venue":null,"work_id":"6d486ee2-55ee-4f71-a1aa-aac1e01edda4","year":2022},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.406127Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:e422be0e878f0d6f2f4092cc27e8a8cf6bc08fe83fb0e59191cfcc886fa6c05c","observation_id":"e724376b-53ca-4deb-906d-b474f9ea0d31","resolution":{"observed_at":"2026-08-08T11:20:50.288052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.268938Z","title":"How NOT To Evaluate Your Dialogue System: An Empirical Study of Unsupervised Evaluation Metrics for Dialogue Response Generation,","venue":null,"work_id":"e0ede788-ea95-4a56-a48f-e97188049548","year":2016},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.410343Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:1a7c3026485767c094e5cd49a8757d20ec98b22aa73034999f6affc43934c53c","observation_id":"076daa87-1662-4e0e-a812-6760369f9178","resolution":{"observed_at":"2026-08-08T11:20:50.273578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.255207Z","title":"SimUser: Generating Usability Feedback by Simulating Various Users Interacting with Mobile Applications,","venue":null,"work_id":"2a220f12-c8c6-4291-b8ed-87f38ee8ca3f","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.414486Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:07f7ccea7eb6be7c57e0b106b2840fe778b987306bd5783ba08e6da12cd141ed","observation_id":"4756293d-6c43-4b11-ae54-dc24d1966a0c","resolution":{"observed_at":"2026-08-08T11:20:50.259491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.241926Z","title":"Leveraging Large Language Models as Simulated Users for Initial, Low-Cost Evaluations of Designed Conversations,","venue":null,"work_id":"a86724c4-1d0b-4943-9470-11b5acd7c907","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.418573Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:48ae63cd19c04446e22beb12495e514f7ea3ce65c60ff4ba631c7a3335f41e6c","observation_id":"90cc9d31-f225-4de6-a773-2efc056098b8","resolution":{"observed_at":"2026-08-08T11:20:50.246189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.228169Z","title":"Can AI serve as a substitute for human subjects in software engineering research?","venue":null,"work_id":"9b230e6b-1844-4efd-8d91-69c672746bc9","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.422636Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:7ed9644ebf265e867543216bbe23ec3db63bf844dbe9fd34abf8c5036cdb3d6f","observation_id":"5ea89da4-c6ad-4bf3-91d6-dd37042f3801","resolution":{"observed_at":"2026-08-08T11:20:50.232583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.214279Z","title":"Judging LLM-as-a-judge with MT-bench and Chatbot Arena,","venue":null,"work_id":"f4f11879-7466-40e0-b617-40416a80ab66","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.426813Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:1cdb6ac75d011f0ba5980abf38525ca55a9034a67e4513c73afbeff9cfd4d3fa","observation_id":"a1fefa01-c276-4267-a430-f27290901894","resolution":{"observed_at":"2026-08-08T11:20:50.218481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05534","last_updated":"2025-02-04T22:37:06Z","snapshot_observed_at":"2026-08-06T14:18:45.256315Z","submitted_at":"2024-08-10T12:30:01Z","title":"Can LLMs Replace Manual Annotation of Software Engineering Artifacts?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05534","snapshot_observed_at":"2026-08-08T11:20:48.430892Z","title":"Can LLMs Replace Manual Annotation of Software Engineering Artifacts?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.430892Z"},"links":{"cited_paper":"/paper/2408.05534","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:665c649737d6dc12482a4a82288eaa216bcbcbe540496c74ae8280a49a797bd4","observation_id":"cbb663ca-e99b-46b8-b065-aa8e1c247304","resolution":{"observed_at":"2026-08-08T11:20:48.430892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.200395Z","title":"GenderMag: A Method for Evaluating Software’s Gender Inclusiveness,","venue":null,"work_id":"3fed9184-344e-421a-9c60-c08a6201ea84","year":2016},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.435767Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:78097e8184eec095cbb85f0890f9329f77f782bf6b3e103c12536e02afb3b045","observation_id":"d626cf25-3863-4ae4-9b10-02c7ad4f7e09","resolution":{"observed_at":"2026-08-08T11:20:50.204756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.186186Z","title":"How to debug inclusivity bugs?: a debugging process with information architecture,","venue":null,"work_id":"8ef0a1b6-0268-4a27-8452-8dc0b5eac5fa","year":2022},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.440124Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:42d8fec0fd7db5d93ff40308228ebed700322a9166cf82ddd065ffb83fe2b124","observation_id":"1c3727d9-b534-4319-865a-c8b58c61f72c","resolution":{"observed_at":"2026-08-08T11:20:50.191003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.172118Z","title":"Guidelines for Human-AI Interaction,","venue":null,"work_id":"8377b581-d535-444b-a71b-b2e6732bda88","year":2019},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.444346Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:d93af4f6c9442688c79de6f2d56bd6669af96792a9d6e265b4207d0f2d66430a","observation_id":"7a7a07ba-5293-4bad-95e5-fa9967550eee","resolution":{"observed_at":"2026-08-08T11:20:50.176398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.157986Z","title":"Using an LLM to Help With Code Understanding,","venue":null,"work_id":"09ca6677-1c51-472d-8afe-0ded0ae9ad6c","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.448490Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:b5d3368a3efcc536ad79a299b326a5ecdcc74084b38f2c15b136dc290be63b6e","observation_id":"355815da-fd27-4ff1-b95c-6f242ad7d458","resolution":{"observed_at":"2026-08-08T11:20:50.162481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.142185Z","title":"What You Need is What You Get: Theory of Mind for an LLM-Based Code Understanding Assistant,","venue":null,"work_id":"4c8b8d1e-5deb-4559-b04d-434210ee63d6","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.452788Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:3532d67b5574291ee83bac3bd67a4a8b14e65ca4991bf3f3e16abc409a25bea3","observation_id":"8f5cc053-c8c4-48e0-874c-ee0b12c65f42","resolution":{"observed_at":"2026-08-08T11:20:50.146901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-03T08:33:58.422749Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-08T11:20:48.457016Z","title":"Safeguarding Large Language Models: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.457016Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:08f6e4e8afde41d3846f0847d0eb496b571e295f6946b4c357f102cf91a21263","observation_id":"32d914df-89e9-4282-a656-032a9425cd88","resolution":{"observed_at":"2026-08-08T11:20:48.457016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.127137Z","title":"Large Language Models can Accurately Predict Searcher Preferences,","venue":null,"work_id":"1685d955-e111-4c5f-ac64-83765f221dc9","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.461914Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:c435d606a3d76e57fa22b03d45a02dbfd6b069379b627e7c5eb6a4cac1cfef87","observation_id":"d58b4392-2252-439d-b65d-61e5d6403d63","resolution":{"observed_at":"2026-08-08T11:20:50.131691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.111436Z","title":"Trends, Challenges and Processes in Conversational Agent Design: Exploring Practitioners’ Views through Semi-Structured Interviews,","venue":null,"work_id":"674d1861-a4dc-42f8-bd15-67ebf247a4e9","year":2023},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.466258Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:0dea41d2865256fa92b118bb2fc05c31ef8d38112912ec66fb9094ccfcb009ba","observation_id":"79849c58-eb89-4e69-afdd-0e9260df1382","resolution":{"observed_at":"2026-08-08T11:20:50.116328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.095227Z","title":"Evaluating Large Language Models in Generating Synthetic HCI Research Data: a Case Study,","venue":null,"work_id":"bbe53808-42b9-4cbf-bf55-536dc13697e6","year":2023},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.471029Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:6693d77b8fb54bc55477b4324b5ab223acd8e242946b38b6c96e06659b0524d1","observation_id":"4eae2d72-ceb2-425d-a8d9-6cfc3261f661","resolution":{"observed_at":"2026-08-08T11:20:50.100192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05984","last_updated":"2023-10-05T18:26:06Z","snapshot_observed_at":"2026-07-06T16:30:00.114521Z","submitted_at":"2023-10-05T18:26:06Z","title":"Simulating Social Media Using Large Language Models to Evaluate Alternative News Feed Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05984","snapshot_observed_at":"2026-08-08T11:20:48.475363Z","title":"Simulating Social Media Using Large Language Models to Evaluate Alternative News Feed Algorithms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.475363Z"},"links":{"cited_paper":"/paper/2310.05984","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:2aa989a9412ede8a6d7720cd540589c36195afb4cabaf0ab9f3e410b923714a9","observation_id":"2f68c4ab-37c1-46af-bbf9-a05a756d7c10","resolution":{"observed_at":"2026-08-08T11:20:48.475363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04078","last_updated":"2025-01-30T15:11:12Z","snapshot_observed_at":"2026-08-08T16:23:52.748546Z","submitted_at":"2024-10-05T08:15:45Z","title":"TeachTune: Reviewing Pedagogical Agents Against Diverse Student Profiles with Simulated Students","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04078","snapshot_observed_at":"2026-08-08T11:20:48.480511Z","title":"TeachTune: Reviewing Pedagogical Agents Against Diverse Student Profiles with Simulated Students,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.480511Z"},"links":{"cited_paper":"/paper/2410.04078","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:cb1bc64657cc5dc3616582a4418b88b47b365d6de68535eae1a4ac2c38d319bc","observation_id":"131f98ee-ef7b-4f3b-8825-b0f763118434","resolution":{"observed_at":"2026-08-08T11:20:48.480511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.080024Z","title":"Can ChatGPT emulate humans in software engineering sur- veys?","venue":null,"work_id":"53d4ca0e-1ed4-4437-9d8b-9f11405cc1b9","year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.485128Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:709e4fad6d55cb5791e672940d67e6badee288e463258d95ca2622acf97c8cea","observation_id":"11503796-0e0e-47c0-8993-61aca8fac571","resolution":{"observed_at":"2026-08-08T11:20:50.084921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18571","last_updated":"2024-03-06T08:07:02Z","snapshot_observed_at":"2026-07-06T17:37:01.208330Z","submitted_at":"2024-02-28T18:58:25Z","title":"Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18571","snapshot_observed_at":"2026-08-08T11:20:48.489366Z","title":"Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.489366Z"},"links":{"cited_paper":"/paper/2402.18571","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:84bb634ebf74158fb0fc856e568093b5294083a74ab26dc196996e11d8feab8f","observation_id":"b5c40558-960e-416e-b402-753a034c8944","resolution":{"observed_at":"2026-08-08T11:20:48.489366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10811","last_updated":"2024-06-17T11:06:57Z","snapshot_observed_at":"2026-08-09T10:07:30.221462Z","submitted_at":"2024-02-16T16:35:35Z","title":"Quantifying the Persona Effect in LLM Simulations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10811","snapshot_observed_at":"2026-08-08T11:20:48.494024Z","title":"Quantifying the Persona Effect in LLM Simula- tions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.494024Z"},"links":{"cited_paper":"/paper/2402.10811","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:4af334e926bfa36f2922cc08262a2775d844f8267fd9d10721d054454ec6cc47","observation_id":"c011a80c-ae69-4b41-9bd1-0b3a5b30ab5b","resolution":{"observed_at":"2026-08-08T11:20:48.494024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11657","last_updated":"2024-06-17T15:41:30Z","snapshot_observed_at":"2026-08-06T10:04:21.484738Z","submitted_at":"2024-06-17T15:41:30Z","title":"Can LLM be a Personalized Judge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11657","snapshot_observed_at":"2026-08-08T11:20:48.498755Z","title":"Can LLM be a Personalized Judge?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.498755Z"},"links":{"cited_paper":"/paper/2406.11657","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:e0480a25f396c1dd28f132490ff628222b27a8f0642eb89464bac4a373831e69","observation_id":"646ea53d-a55e-40eb-87fa-83ceb392d036","resolution":{"observed_at":"2026-08-08T11:20:48.498755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.064516Z","title":"Characterizing Software Engineering Work with Personas Based on Knowledge Worker Actions,","venue":null,"work_id":"cc84c423-f947-4413-85fc-4e86405279e0","year":2017},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.503560Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:d096a464d4e32ddf0267cffd03d790b0b73df07c65bbc52d9f1624abadcc0007","observation_id":"3ec0ac57-e9ce-4eb0-9739-5fb923b9ff43","resolution":{"observed_at":"2026-08-08T11:20:50.069367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.049143Z","title":"Out of One, Many: Using Language Models to Simulate Human Samples,","venue":null,"work_id":"80d10cde-fe3a-4289-80ed-a0023f9fb71e","year":2023},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.507941Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:1f34c56b20ace62a19611ecd05a57317ef7aa5fb38fed7d2264683f5c458e9be","observation_id":"0fe8e11b-5643-49d6-b01c-ce3aa1f24775","resolution":{"observed_at":"2026-08-08T11:20:50.053933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04049","last_updated":"2024-12-17T17:17:21Z","snapshot_observed_at":"2026-08-08T23:37:50.668829Z","submitted_at":"2024-02-06T14:51:55Z","title":"Systematic Biases in LLM Simulations of Debates","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04049","snapshot_observed_at":"2026-08-08T11:20:48.512020Z","title":"Systematic Biases in LLM Simulations of Debates,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.512020Z"},"links":{"cited_paper":"/paper/2402.04049","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:a56e1e1424720097993a7c460b36f1e652882db17077af88f9f2123ce335c834","observation_id":"e3d0ab46-adf6-446d-b23a-8cfed4d96147","resolution":{"observed_at":"2026-08-08T11:20:48.512020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01908","last_updated":"2025-02-03T16:28:59Z","snapshot_observed_at":"2026-08-09T10:07:39.940001Z","submitted_at":"2024-02-02T21:21:06Z","title":"Large language models that replace human participants can harmfully misportray and flatten identity groups","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01908","snapshot_observed_at":"2026-08-08T11:20:48.516339Z","title":"Large language models cannot replace human participants because they cannot portray identity groups,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.516339Z"},"links":{"cited_paper":"/paper/2402.01908","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:9f40a21f428f063913ac948f914087a64885ddba22436da29b349443a4a24e3d","observation_id":"a531e1b5-c86b-43d9-90d3-eee467abd4e1","resolution":{"observed_at":"2026-08-08T11:20:48.516339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:20:50.030843Z","title":"Supporting Con- textual Conversational Agent-Based Software Development,","venue":null,"work_id":"700706f0-ed5b-4457-86f1-2e974af26dd0","year":2023},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.520480Z"},"links":{"citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:94dcec281f5681b5946ec1ac1397ae6dabb68d9310371ee985b977984213e44b","observation_id":"566caccf-1531-4b4f-a0bd-cb83bb80db71","resolution":{"observed_at":"2026-08-08T11:20:50.037619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-08T11:20:48.524542Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.524542Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:0d7ec4b6d40df2c0a03e7f27298651badaa1c7bcd356e7da9f45821515d91d7d","observation_id":"2d9d19aa-3a82-4771-8a84-46adbe57fd25","resolution":{"observed_at":"2026-08-08T11:20:48.524542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-09T10:07:37.135839Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 3 inbound Pith citation observations for arXiv:2502.07956."}