{"as_of":"2026-08-06T02:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0987d6b465d6128ef8fe63b6c057eda1833bcff6a62ff955a635eaa24e854544","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T23:53:23.807636Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.20629/citation-record","integrity":"/paper/2606.20629/integrity","json":"/paper/2606.20629/citation-record.json","paper":"/paper/2606.20629"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Openai Codex: Cloud-based autonomous coding agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:59a15c2af48652d6353875c0575c8bb15e73273a01ec1fbc1f2ff5e5a40321c6","observation_id":"79f712c4-249e-4ce6-9f04-198bfd3173ab","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Composer 2 technical report","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:54fbd7bc387c884999ab798d388d268d9d1de605efa1aa51ce904ac82fa62cfe","observation_id":"1bc9c17d-2eac-409d-a1b0-43ce5f57d901","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Opencode: The open source AI coding agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:3283c672b28c202962e3d661d010939aafb10742cd0fd99dd332da2f55846e2f","observation_id":"4d27378d-05b4-4d3d-9bf5-240ccc426374","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"AutoGen: Enabling next-gen LLM applications via multi-agent conversation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:f021c8c267ef3467979894be86262f1283c8f85e03c7e676adf70c50e4ec31ad","observation_id":"1bdee960-a5f5-4960-bbf8-d2fcea4b2416","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-07-31T19:03:03.494918Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":"2308.08155","doi":"10.48550/arxiv.2308.08155","metadata_source":"pith","pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","venue":"cs.AI","work_id":"92b7eb9c-c3d8-4518-a376-06fa15dd895b","year":2023},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:ca0a94b0331c9f2fd08c7a648cdebcbe8f704f4d072cd45b7e7effbfd35a3630","observation_id":"04d4f805-31c3-4a6b-9bc8-9efadf469c38","resolution":{"observed_at":"2026-06-29T00:02:50.052985Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.607676+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.607676+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Google agent development kit (ADK)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:1e40efd92b4a623c63f9d83778c63829e77e600691cdb2c26dc9b00a615ef8d6","observation_id":"74ef4790-c49e-43ba-b078-6701a2b9083a","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Kimi agent swarm: Let 100 AI agents work for you","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:998b7a74a1d909e76266f47ef6921e073a2c5475a5d5ad2df78b9180da5db5b9","observation_id":"9801b847-80ed-49be-9844-c884feee7c18","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"How we built our multi-agent research system","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:af085006eec401192b3f238dbbd9f506727250c3eede6f899a2dc366095cc1c6","observation_id":"f87bf670-e640-4976-ae6f-9f81856d93d2","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Don’t build multi-agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:e6d932a6557d5a99dd17355222e145cc65e9718680a6b521917d662551a8471e","observation_id":"7dbfca96-8bae-4789-a4ec-d8ddc694872d","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"MCP Atlas leaderboard","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:22a6b0f5873c32f32a96114f823721f8cf447f1c9a7a37899f88be481c24da2c","observation_id":"c0186a31-29de-40ad-9746-0b6cb31069aa","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:40a208761bb2eec05e2388b7c220c598cef2e8e92ed74b42840f84a81badd8e1","observation_id":"e23c27c9-44ab-4019-ac48-20d42f662b32","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.147","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Plan-and-solve prompting: Improving zero-shot chain-of-thought reasoning by large language models","venue":null,"work_id":"4f3d6305-8779-429c-ac2c-14562b2377c6","year":2023},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:79f2755b0ed095d7d16c7fb740e501c86f4382a7aa3463bb335b84db24c00769","observation_id":"382a8914-f5c4-42c6-8e62-8cc41fe905fe","resolution":{"observed_at":"2026-06-29T00:02:49.525429Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:24:49.72957+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:24:49.72957+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"ReAct: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:4373e12c2b74de32ccf9c745ab75fd9f674d685ba94727258498342c19172b60","observation_id":"0acdb22a-c0f2-4ce3-8898-d7aa38f196e8","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"HuggingGPT: Solving AI tasks with chatGPT and its friends in hugging face","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:eb4d5e773d77c2274020f9b593deb19c07dc86602db8954ebd9279fb0a75305f","observation_id":"4eb8693f-bd26-4b0b-b453-e1de5a6eebcf","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:da3c23f2135f4ee48b32ed6d20a248c43e5892ecfc6792f492120df67a8c2870","observation_id":"cb370eac-42bb-4c58-a99f-1ff26291d486","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"An LLM compiler for parallel function calling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:c9892d63eaf9437b2541b38244b3130894e2e16c32fc0dc4e92328513714131a","observation_id":"be87b34e-8949-466c-ba0e-b25461a7b94a","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Plan-and-Act: Improving planning of agents for long-horizon tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:5277e3a487d7847aa8bd80c01175372690d3809676c1ce6550b17ac7414a62ed","observation_id":"c991e79d-4c2e-4cd9-a926-c4e7c2027a64","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"GitHub Copilot CLI v1.0.18: experimental critic agent for plan and complex im- plementation review","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:d29b7ba8c77343672fe942353041300baadb3f1e556221a2ccd1cbec8e55261b","observation_id":"05fa93c7-4f3e-49a8-9a11-f9318c4e771d","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Best practices for coding with agents: Plan mode","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:c490e0ac98aad7d7ba50ab5309dcb6ef2e51d782ebdc608281f03f5b4b396a2b","observation_id":"04610ec5-11e7-4543-a63b-62ab62d3d130","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"State of AI 2025: An Empirical 100 Trillion Token Study","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:f88d4b9b763342c88cc0c0acd02b49bda71ad808f30ac367c5e3c992dbbda6cd","observation_id":"05487bb4-58fc-4c57-bd5f-3410dd134ac5","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:59b285dce81f15bc590d4b1e04bb0ff1c5610b12b4324bb10163a5d166deacd9","observation_id":"ac343516-7019-4d0b-a3fe-cd527fc24f93","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14527","last_updated":"2024-07-22T10:56:19Z","snapshot_observed_at":"2026-07-06T18:04:00.217896Z","submitted_at":"2024-04-22T18:56:18Z","title":"M\\'elange: Cost Efficient Large Language Model Serving by Exploiting GPU Heterogeneity","version":4},"cited_work":{"arxiv_id":"2404.14527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.14527","snapshot_observed_at":"2026-07-03T12:48:11.776825Z","title":"M \\’elange: Cost efficient large language model serving by exploiting gpu heterogeneity","venue":null,"work_id":"bc062082-bb69-4c79-9bda-625aac03fada","year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"cited_paper":"/paper/2404.14527","citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:a8b55ce1bcb1bf3b119997897f184cce66a06ac228c1f1100ae9aa9d3c9e39b3","observation_id":"40952af5-02c5-45d4-a60c-9b9150df9633","resolution":{"observed_at":"2026-06-29T00:02:50.069860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.07067","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:57:50.812806Z","title":"Moe-cap: Benchmarking cost, accuracy and performance of sparse mixture-of-experts systems","venue":null,"work_id":"3f67403a-5196-434b-a555-c41a397c1e0b","year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:6e4da2af6ce6bd43e0a53d18f8d7ca53df3376e97b827f97afe13aa259bda32c","observation_id":"a285b70b-ff9a-46c1-82ea-ff45d24b4ce5","resolution":{"observed_at":"2026-06-29T00:02:50.066968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.findings-eacl.237","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PEAR: Planner-executor agent robustness benchmark","venue":null,"work_id":"ebb645ed-64f0-408a-b1b6-4e437d6b3c63","year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:7c4b931f1488418dc9b12185d9be01ebfc0ebb0aca0249ca080e82aa8da44091","observation_id":"37d2a1d4-7ff3-466b-bbcd-43e43c8bd0d1","resolution":{"observed_at":"2026-06-29T00:02:49.525203Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"How handshake saves 50% on LLM GPU costs with anyscale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:9ac02fea412c4d3687e55c834320fbe66b44c1ac0aa960946baa8518e9c6333f","observation_id":"b891cf4e-43e4-4a48-b505-ab11c1b42822","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Making AI more accessible: Up to 80% cost savings with Meta Llama 3.3 on databricks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:f6902dd95f2ee0ca10ee57beeee2de66ad086dab76530930dd55d4423f5c6358","observation_id":"1c7071e0-f5cd-43b8-9d4a-9bb1b44f4dfa","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.04301","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:13:58.849169Z","title":"The cost of dynamic reasoning: Demystifying ai agents and test- time scaling from an ai infrastructure perspective.arXiv preprint arXiv:2506.04301","venue":null,"work_id":"0182ca18-01cd-490a-a563-c6ee24924649","year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:6edf874bbae87ac8bc9c6c51b4f9038de5ecd6a596ec5075e33d235a5179de1f","observation_id":"c9563a86-e384-43fb-870e-ff69fc102d85","resolution":{"observed_at":"2026-06-29T00:02:50.073049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Narasimhan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:22c4f8ca6828a818c0c0aa0f393ea2d76eb949d1645ffe01afcadf97b307286f","observation_id":"3f060c76-b569-4c6a-a771-0bb554aa118f","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-07-06T20:45:59.818273Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:3f4be55d89d841ce4c2d6927cec1a5bdc646dddb91a52347e0af52148871d66d","observation_id":"50ca8191-5879-40c2-9331-230a41baadee","resolution":{"observed_at":"2026-06-29T00:02:50.061568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14161","last_updated":"2025-09-10T08:35:19Z","snapshot_observed_at":"2026-08-01T16:27:28.241667Z","submitted_at":"2024-12-18T18:55:40Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","version":3},"cited_work":{"arxiv_id":"2412.14161","doi":"10.48550/arxiv.2412.14161","metadata_source":"pith","pith_arxiv_id":"2412.14161","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","venue":"cs.CL","work_id":"8ba3cce8-4fc7-4286-9bae-513243ed4e6e","year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"cited_paper":"/paper/2412.14161","citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:025b8c68004d6b027f40ee98e45eda88e7d8eed685198c40f88610a92dc6442f","observation_id":"efea63a8-c9e3-4405-ad93-36f2b0168376","resolution":{"observed_at":"2026-06-29T00:02:50.055749Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.00481","doi":"10.48550/arxiv.2601.00481","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MAESTRO: Multi-Agent Evaluation Suite for Testing, Reliability, and Observability,","venue":"arXiv (Cornell University)","work_id":"c3a6eefd-c666-4eb8-98b4-8fda864f24dc","year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:362d80c0a4e3369981b69e0294fa507e73e7536157d9c5e6d3efcd2d12aa27e0","observation_id":"1df28599-1ff0-4e96-98b2-00aa73e1ed6f","resolution":{"observed_at":"2026-06-29T00:02:50.058510Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Holistic agent leaderboard: The missing infrastructure for AI agent evaluation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:0a1a27c6a3c88a16af665bfae969d39029534c7c0f5d1ae02a4cdc5c7f06995c","observation_id":"f6c13d0c-db70-4e94-b37e-ed83867c9dbc","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1056/aidbp2500144","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NEJM AI , volume =","venue":"NEJM AI","work_id":"6fe15744-e824-42b1-8bec-593bcf4ea7c0","year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:899b075f7d7801fe63a2a358229e537b1c84fff46fd90392db8497314de72fe1","observation_id":"57695622-0c5d-4469-b3e8-e9d457464d6c","resolution":{"observed_at":"2026-06-29T00:02:49.527723Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:22.930492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:22.930492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11944","last_updated":"2023-11-20T17:28:02Z","snapshot_observed_at":"2026-07-06T16:50:06.095609Z","submitted_at":"2023-11-20T17:28:02Z","title":"FinanceBench: A New Benchmark for Financial Question Answering","version":1},"cited_work":{"arxiv_id":"2311.11944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.11944","snapshot_observed_at":"2026-07-04T20:40:08.190653Z","title":"FinanceBench: A New Benchmark for Financial Question Answering","venue":"cs.CL","work_id":"b60d115e-50dd-42f6-9178-5d29b05e1e89","year":2023},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"cited_paper":"/paper/2311.11944","citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:969c867acebbdfb68b8b8b6d3f02412b480104ec34b5df156763f20a291865a8","observation_id":"b5794e43-06ca-49c4-a533-d089e912bb6a","resolution":{"observed_at":"2026-06-29T00:02:50.064013Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:8437105a4aab27b6449c520d60df66b37b524e0c7d1197b7b798e246ade5eff1","observation_id":"068a262d-f5f6-4b92-aed7-3c60458ab4b9","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:d59a04e30cdba80b22253a7ace304b0b40e3d3a733afacec2899704372894c5a","observation_id":"5393f520-14c4-468f-861e-2b0a707602b7","resolution":{"observed_at":"2026-06-29T00:02:50.075775Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Oh my OpenAgent (omo): Multi-agent harness configurations for OpenCode","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:a0ad39b26ee76586ba9a9da896e61bd3e4de3a37c2ec83ae2a9f12bd9115d31e","observation_id":"6897768f-2ea1-4fa5-a74a-50bbad87260a","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Vast.ai pricing: live H100 marketplace listings","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:6310f0a679876a53fe720fb67dba07b2c5de733ec06095ac8f43b55de28f3767","observation_id":"ce56d822-67cf-40ca-b665-d632934a2ac9","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:93652ed33be3d38123dcce7dbac1488ca710b05d956865310e0b6005a1aef629","observation_id":"fb8935f4-d5f2-4dbf-aa29-df6a849f34b9","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Large Language Models cannot self-correct reasoning yet","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:b67e00d0364f1f448fa22c3d76c5e4f78af3d49197d98a20106b2ba46f88bfaf","observation_id":"3ee93fe6-f065-4662-a4ef-4e9b1851563c","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"H100 rental prices: A cloud cost comparison, October 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:7efa7e34b6b710fd8e4c07ec6d88945da20c16286cb433ba2a1b78abd2b9fe34","observation_id":"786d98ae-98e6-40ba-84a2-15b4be693f15","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Hyperstack AI cloud pricing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:444b18c9a3e246b949d17eb1f4e8f2977a84fb2074927904e88cbad61d03e47f","observation_id":"1524504b-894c-4739-9af8-88a9ef69e375","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:43a518d3ab1026412812655c71c0449425032996368362691283d1ee1aebfec7","observation_id":"1676bfc7-dd4d-40e1-81fe-34af42d05e1f","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"H100 rental prices: The $2 vs $98 gap explained, March 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:03eecb92930c4a9f1f8edc6577882ea33459a55d55b89b20d325c9fc1acff80f","observation_id":"80685dd2-e723-494c-a15e-c96cada6a7a7","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"NVIDIA DGX H100 system datasheet (8×H100, list price reference)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:77e6f743ada3f3629312c780c447117f139f01af5ee9fe8437b93fed8e535718","observation_id":"e446f31d-a879-4aff-87c6-5c8e17569afb","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"Energy Information Administration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:e2bb11630c9b24c4b8f50b319243adcc6c32e17fde60e9218142e97955cb827b","observation_id":"df020f04-0bda-4168-b2f6-df4ca926ecdc","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:53:23.807636Z","title":"role-criticality under a specified upgrade path","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:b35083e3104fc364481c78bbd0d12277e2ec0c4aa1a9c2dc927305d5a07e5ca7","observation_id":"81006fcd-081a-4964-8226-68793192ee70","resolution":{"observed_at":"2026-06-28T23:53:23.807636Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":1,"metadata_mismatch":4,"parse_uncertain":3,"unresolved":31,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2606.20629."}