Buyer prompt · published evidence

Design a retrieval benchmark for AI research assistants using known-item search, long-tail evidence, conflicting sources, dates, and paywalled material.

An exact prompt-level view of which reviewed brands surfaced and which public URLs the configured AI models cited. No answer text or tenant data is published.

Intent
commercial
Model providers
3
Categories
1
Last observed
Aug 25, 2026, 12:00 AM UTC
Competitive outcome

Brands surfaced

Ordered by provider breadth, then total mentions and owned-domain citations. A mention is not an endorsement or a position claim.

#BrandCategoryProvidersMentionsOwned citationsProvider evidence
Model comparison

Answer matrix

One row per configured provider and category snapshot. Hashes prove answer identity without publishing stored answer text.

ProviderModel versionCategoryBrands surfacedCitationsUnique domainsAnswer hash
Openaiopenai/gpt-4o-miniResearch AINone observed0097530899…d6682
Anthropicanthropic/claude-haiku-4-5Research AINone observed007f80b04b…d38fc
Geminigoogle/gemini-2.5-flashResearch AINone observed00f4cb48da…66865
Snapshot IDs87e6acfa-8e14-4c4e-ba2b-0942f94ccc86
Corpus versionsai-research-assistants-2026-07-27
Benchmark versions4-ai-research-assistants-2026-07-27-models-64232fd32583

Coverage: Research AI. Full answers stored: no · Full answers published: no · Tenant data included: no.