{"as_of":"2026-08-07T18:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a75d9d9535a8108d17b405c3012167cafe3d4f8a075b003ad78babcc54321cbb","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:29:09.202017Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.06683/citation-record","integrity":"/paper/2604.06683/integrity","json":"/paper/2604.06683/citation-record.json","paper":"/paper/2604.06683"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mathqa: Towards interpretable math word problem solving with operation-based formalisms","venue":null,"work_id":"9553d65f-7790-40b2-895e-7d2a45a6e951","year":2019},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:9bb9bd8e8ab7b4e9b90a9ed63b25800ccbde972a438453e142bde5e5fde81b48","observation_id":"82741301-51c7-42dc-aa9a-70212ffc191e","resolution":{"observed_at":"2026-05-17T02:33:53.022252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:9095118fe80978b18e70c68e82ff441481e17a31cde0a6f13ca3a571403f449d","observation_id":"8b2ecd7d-23f2-4028-b36b-623bd33ec61d","resolution":{"observed_at":"2026-05-11T00:30:53.126418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Software architecture documentation in practice: Documenting architectural layers","venue":null,"work_id":"c556fd4b-8071-4612-a932-ebe626dd3c08","year":2000},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:8e5d86e5cd36e6240eddd392366097e1212a899b8ab08c25c251539a083d3c83","observation_id":"e8f42a16-a396-4752-b0b7-8c2f24543b01","resolution":{"observed_at":"2026-05-17T02:33:53.027649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Assessing the suitability of large language models in generating uml class diagrams as conceptual models","venue":null,"work_id":"34e9968e-4116-4446-9c49-d4bfd943f7ae","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:7d3bdfb085bc94f17eea49fc05fe29a80ccd8d1a37bab033a5a0604ec4c38b96","observation_id":"a1eb5317-b036-4790-b7bf-b609390b4492","resolution":{"observed_at":"2026-05-17T02:33:53.032834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the assessment of generative ai in modeling tasks: an experience report with chatgpt and uml","venue":null,"work_id":"4139fc28-ad9d-4a97-9930-459d86a01c91","year":2023},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:c0a553aed4c358f21b1ee0af406b9c7d026b8f0123b38eccdc39ee06a472660a","observation_id":"08a4946e-01ff-4797-870a-86ea7f3bfbf0","resolution":{"observed_at":"2026-05-17T02:33:53.019308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:05f6773c489946a052ab1c32f5af382ab7873018260b2bbc0ab0f1f3bf35841c","observation_id":"14a9cace-8f07-4bc0-9da5-692b80e7f91a","resolution":{"observed_at":"2026-05-11T00:30:53.141148Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can llms generate architectural design decisions?-an exploratory empirical study","venue":null,"work_id":"23a43317-5294-4245-b289-1282ce94d3de","year":2024},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:181cd24bd7f26ceab4c843fe4dc13689416f1a0b6a6a4299eea9409391e39603","observation_id":"de570f53-e4db-454a-ad3c-17013dcae278","resolution":{"observed_at":"2026-05-17T02:33:53.030400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11248","last_updated":"2023-11-17T02:51:39Z","snapshot_observed_at":"2026-07-06T16:34:31.299748Z","submitted_at":"2023-10-17T13:18:01Z","title":"CrossCodeEval: A Diverse and Multilingual Benchmark for Cross-File Code Completion","version":2},"cited_work":{"arxiv_id":"2310.11248","doi":"10.48550/arxiv.2310.11248","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.11248","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crosscodeeval: A diverse and multilingual benchmark for cross-file code completion","venue":"arXiv (Cornell University)","work_id":"6213ac7f-efeb-47b2-9266-df03f9b731af","year":2023},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"cited_paper":"/paper/2310.11248","citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:d1a92ca2eaa68fb05f0542f0df113dda38803f9a3fd929ed15d7172c02ede955","observation_id":"c5c24daa-1288-4ca6-ba1d-6d139e1ca80c","resolution":{"observed_at":"2026-05-11T00:30:53.153123Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01861","last_updated":"2023-08-14T09:07:00Z","snapshot_observed_at":"2026-08-03T22:16:12.497107Z","submitted_at":"2023-08-03T16:31:02Z","title":"ClassEval: A Manually-Crafted Benchmark for Evaluating LLMs on Class-level Code Generation","version":2},"cited_work":{"arxiv_id":"2308.01861","doi":"10.48550/arxiv.2308.01861","metadata_source":"pith","pith_arxiv_id":"2308.01861","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2308.01861 , archivePrefix=","venue":"cs.CL","work_id":"499690c6-9314-4f87-b716-acc32d7b513c","year":2023},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"cited_paper":"/paper/2308.01861","citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:dce960abdd40ddfed70646fdb39575afe916f7dbfb05db04bfe1b5f168e83889","observation_id":"c6cdb260-851c-441f-af74-1efa4759c57f","resolution":{"observed_at":"2026-05-11T00:30:53.119918Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Erni and C","venue":null,"work_id":"32ceb2dd-562a-4d1c-8014-1b71498dc58c","year":null},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:1c4e704091fcce7a8cd3ce18a1df395b6860c74915df172ddb01405501995906","observation_id":"2093ceb7-6e83-4e33-8950-c90976c7c51d","resolution":{"observed_at":"2026-05-17T02:33:53.024759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1996.492444","doi":"10.1109/metric.1996.492444","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"d76372f7-7608-4ae0-ab1d-a52bb04a8cc6","year":1996},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:4739ad0d4873aa1cfba3d856f857cc308adcf49f4d3aac08dde04d49c39dda66","observation_id":"67dc89eb-c377-4cbf-9f32-f949bd3345fa","resolution":{"observed_at":"2026-05-10T18:30:42.834015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on llm-as-a- judge.The Innovation","venue":null,"work_id":"1dfcc100-8933-42df-b956-95061ae8fafc","year":2024},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:7c7c278e9b8b4a3fe13ccf5aa98fc306d874a8ad85bea1bb41131d072b785809","observation_id":"19e60196-bab4-4112-9814-f85aa389a6d6","resolution":{"observed_at":"2026-05-17T02:33:53.035335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T11:56:12.603753Z","title":"MetaGPT: Meta programming for a multi-agent collaborative framework","venue":null,"work_id":"91a157e1-40d5-4c9f-8bae-c988c9c4ea11","year":2024},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:979823ecfca233bc4550da5591de5a53fafb225b759f4435263cc40292620445","observation_id":"864208b2-b7c8-484a-90e4-0355648f2f74","resolution":{"observed_at":"2026-05-17T02:33:53.037781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models for software engineering: A systematic literature review.ACM Transactions on Software Engineering and Methodology, 33(8):1–79","venue":null,"work_id":"db704d1a-01fd-4ebc-a502-648f1aafc77e","year":2024},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:7e60b3a9c2a04689021bfae1f65f88e250eb4b7f4db0b487d36b985c13f18d11","observation_id":"04b7dddc-bda8-47ab-a31d-86aa83496536","resolution":{"observed_at":"2026-05-17T02:33:53.052729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Role of ai in requirements engineering","venue":null,"work_id":"bfb5bb5c-8e62-453d-b73e-970c2cffea74","year":2023},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:a6cf452bd553f12b07447035aee979aaaffc0f154fb43d391f69bfa1f0082cbc","observation_id":"0319fbe5-e359-4dbd-a0bb-767511f6469a","resolution":{"observed_at":"2026-05-17T02:33:53.047736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The unified modeling language reference manual","venue":null,"work_id":"320b6448-9b4d-4b9c-92b9-432bd1db7403","year":2021},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:31f7f70af57340e00725475ecbe72ca91de0288708a0513dd8008ec520cf98e6","observation_id":"e6e759d7-9800-43e2-a6be-6d2279fe4791","resolution":{"observed_at":"2026-05-17T02:33:53.049946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testgeneval: A real world unit test generation and test completion benchmark","venue":null,"work_id":"c1b1031b-5063-4981-834f-c1a1468c439f","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:17838fce8acd9cde31b38d7c2066fd0cb684f4b0310d670864c8d2d5eaef49e4","observation_id":"f561b1c9-a849-4f95-a97b-443185be38ed","resolution":{"observed_at":"2026-05-17T02:33:53.045674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:02:31.127728Z","title":"Survey of hallucination in natural language generation.ACM computing surveys, 55(12):1–38","venue":null,"work_id":"76c062d0-6611-4a32-9493-bd21a93f2bf1","year":2023},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:4fb19d0b8d427fb6e0808450464f326ce59487ec8f311f028bbe72bbca785bdf","observation_id":"f9463452-975f-4659-905c-a9c440bb1d46","resolution":{"observed_at":"2026-05-17T02:33:53.057860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompting large language models to tackle the full software development lifecycle: A case study (devbench)","venue":null,"work_id":"26374e47-316e-422c-9a80-03bd6416e132","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:73fbed0df045929871dee5c7acd4099f99b63c8ac92150b71d52a573d97897da","observation_id":"d5b74280-14a8-4aa0-ad23-a283df4b56fa","resolution":{"observed_at":"2026-05-17T02:33:53.055186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T10:37:02.016439Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":"ab9cb640-34d3-454d-8045-b23d7e537d81","year":2004},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:bad047dc950bcb1118f511d0fb6d00f7c774cbe6fe3a3cfa110c1fd5e64d9cb0","observation_id":"71a01ba6-55e0-4628-8dbf-1bdcb945c2ee","resolution":{"observed_at":"2026-05-17T02:33:53.078961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"C4 model: a research guide for designing software architectures","venue":null,"work_id":"88b1c9b8-6ca1-4235-ab4a-b7421bcfd0f5","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:12fd3488fced32df366f8c77e942359db78ecdf0c096e65cc8b78c72d6e9aff1","observation_id":"6da977d5-731e-4e0b-ab3f-4a838a1c59cf","resolution":{"observed_at":"2026-05-17T02:33:53.076599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rec- ommended practice for architectural description of software intensive systems","venue":null,"work_id":"0ea25129-5590-4ba8-a27d-8c8a0fb23b2f","year":2000},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:649ff44a19f872e2da3fbab2c3bf0e57cdb5ebd2fe62f0c9e2a86545c52046fd","observation_id":"f6c957cb-3acb-45ff-b1c0-bb24c0c36003","resolution":{"observed_at":"2026-05-17T02:33:53.040254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T10:37:02.032120Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"3767906b-1763-489b-9cad-ef5ce131c855","year":2002},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:1c4409182a62be200ac7d1db424ab3f4db7ca1f782d7028f28b40935ef90d017","observation_id":"bb23b425-4288-411a-b143-b7b846754eca","resolution":{"observed_at":"2026-05-17T02:33:53.063206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sys- tematic literature reviews in software engineering—enhancement of the study selection process using cohen’s kappa statistic.Journal of Systems and Software, 168:110657","venue":null,"work_id":"ad94a7a2-5ed1-453d-9f4a-79411cf979ad","year":2020},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:acb19d1036604b2588aa29ba677c258276839663a1a3d03c9a3a1acc29b41583","observation_id":"9162af84-f866-4733-9947-c930167df4d0","resolution":{"observed_at":"2026-05-17T02:33:53.067723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16697","last_updated":"2025-05-22T14:00:29Z","snapshot_observed_at":"2026-08-07T14:54:28.434749Z","submitted_at":"2025-05-22T14:00:29Z","title":"Software Architecture Meets LLMs: A Systematic Literature Review","version":1},"cited_work":{"arxiv_id":"2505.16697","doi":"10.48550/arxiv.2505.16697","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Software architecture meets LLMs: A systematic literature review","venue":"ArXiv.org","work_id":"5e56880c-e776-4f68-bf82-ce4b624c165a","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"cited_paper":"/paper/2505.16697","citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:4145fb0d127c656bd0207d405d0bc31c16c5981bf6159ab4f9b2b6166b442e6c","observation_id":"06a649f3-b440-4879-8271-36d2b5dd7774","resolution":{"observed_at":"2026-05-11T00:30:53.193676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14967","last_updated":"2026-08-05T23:04:24Z","snapshot_observed_at":"2026-08-07T17:55:49.522378Z","submitted_at":"2025-11-18T23:14:44Z","title":"MermaidSeqBench: An Evaluation Benchmark for NL-to-Mermaid Sequence Diagram Generation","version":3},"cited_work":{"arxiv_id":"2511.14967","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.14967","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MermaidSeqBench: An Evaluation Benchmark for NL-to-Mermaid Sequence Diagram Generation","venue":"cs.SE","work_id":"045681dc-4378-4c1b-beb9-03ce8e6e5d1d","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"cited_paper":"/paper/2511.14967","citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:51acdfc864c68a2f7648e710a1089c926f6293847a8b2b8a559757d082d7c0c7","observation_id":"4af3e750-4c75-4789-84a8-2aa44fd6d5a9","resolution":{"observed_at":"2026-05-11T00:30:53.200344Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Application of the tree-of-thoughts framework to llm-enabled domain modeling","venue":null,"work_id":"225d1a6b-d850-49c8-8f7a-417bdd4eece6","year":2024},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:38f61bd612666ae53868dcec3016508bbcb4f9ad9369b6eb3284e7df398ead0c","observation_id":"0cacff00-a0b5-4b3c-86be-7e00ffac72d5","resolution":{"observed_at":"2026-05-17T02:33:53.074443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.22787","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Collaborative llm agents for c4 software architecture design automation","venue":null,"work_id":"af073f59-418a-45db-8df7-9c8f72544fc4","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:78232d22bbaf0c2c7afb0e9fbedcb64c3ac44b0f49ba2ec38b1d7631e5e894ff","observation_id":"d8a70f91-457a-4af0-99d7-cb4000cfe1e7","resolution":{"observed_at":"2026-05-11T00:30:53.181552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Contest: A unit test comple- tion benchmark featuring context","venue":null,"work_id":"628330ec-52d2-4646-90f2-016f39431c5a","year":2021},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:a4548b98c46cf39cfcdef49a5bdc35fb415e9d87006f1df77b7d97009978b868","observation_id":"46c1c2dc-a90d-43a1-b69c-dd8133990c65","resolution":{"observed_at":"2026-05-17T02:33:53.072223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testeval: Benchmarking large language models for test case generation","venue":null,"work_id":"dc61e3ea-9c8f-4552-926e-b0466e932eb1","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:cbb54a03a4a977b4b4ffd546ae114a307a8ae956e05e942edc1cc0574edc5143","observation_id":"636e62ab-10e8-4820-8303-bbc44aa03ccd","resolution":{"observed_at":"2026-05-17T02:33:53.069913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16741","last_updated":"2025-04-18T18:14:31Z","snapshot_observed_at":"2026-08-02T14:58:44.167588Z","submitted_at":"2024-07-23T17:50:43Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","version":3},"cited_work":{"arxiv_id":"2407.16741","doi":"10.1145/3718958.3750537","metadata_source":"pith","pith_arxiv_id":"2407.16741","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","venue":"cs.SE","work_id":"f1762ea0-e382-4f38-a28c-adc643789859","year":2024},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"cited_paper":"/paper/2407.16741","citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:f0727e354c6f6bbbf4b6658855780178f0c5c870b754de5336fb46b0446b360c","observation_id":"c48d842a-8a82-40a1-bbb6-c1333ce61a16","resolution":{"observed_at":"2026-05-11T07:08:06.116354Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Repocoder: Repository-level code completion through iterative retrieval and generation","venue":null,"work_id":"94398f4a-095e-4604-b816-ffbe32c911a2","year":2023},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:322a97850cd49a2ce4919a63f5c514c9575b7338ffa0acda9716ab104ab51c12","observation_id":"74898c61-df5d-4224-8563-710129465bea","resolution":{"observed_at":"2026-05-17T02:33:53.065435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.03404","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:29:41.832558Z","title":"Towards realistic project-level code generation via multi-agent collaboration and semantic architecture modeling","venue":null,"work_id":"02cff356-60d1-4bfa-bf8d-abcfd11381dd","year":2025},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:5c9a9025221b17ba5450b92aa3ea1db0849e827075e90aba6670a86c20bcff13","observation_id":"9f6baf82-1bc8-46de-baa5-fb76f067c1ed","resolution":{"observed_at":"2026-05-11T00:30:53.167223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:56:18.729506Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena.Advances in neural information processing systems, 36:46595–46623","venue":null,"work_id":"b509e457-b4ed-40f1-a7f4-893bc84cf1f1","year":2023},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:d9c6559bcf2f049c7c6bfc96f4ee586a1cadf7d2f0d7b2d5013dc8712add962f","observation_id":"85d692d5-015c-446c-a72e-0c1982abf198","resolution":{"observed_at":"2026-05-17T02:33:53.060720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Codegeex: A pre-trained model for code generation with multilingual benchmarking on humaneval-x","venue":null,"work_id":"f7b35221-f12b-4d9e-a8b3-f2d094038104","year":2023},"citing_paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:09.202017Z"},"links":{"citing_paper":"/paper/2604.06683"},"observation_digest":"sha256:e706151704270ff755b062952970ac50661f7505ad33ae4780afb49198c04137","observation_id":"70757e43-0783-4fb0-ba10-7d1c729123f9","resolution":{"observed_at":"2026-05-17T02:33:53.042595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.06683","last_updated":"2026-04-08T04:58:36Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T04:58:36Z","title":"Benchmarking Requirement-to-Architecture Generation with Hybrid Evaluation"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":8,"verified_fuzzy":25},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2604.06683."}