TGViewer
AGGREGATOR AGGREGATOR @web3_aggregator · 14.5K subscribers
Post #424358 276

Forwarded from risen.eth

GRASS

Текущая основная модель монетизации: Продажа данных для обучения
Пишут что есть даже клиенты из MAG7
Основной игрок в этой сфере: Bright Data [ 300 млн $ ARR в 2025г. против примерно 128 млн $ в 2024-м ]
Значительные сегменты общедоступного интернета труднодоступны для традиционных лабораторий ИИ на этапе предварительного обучения. Веб-сайты ограничивают частоту автоматизированных запросов, демонстрируют разный контент в зависимости от географического положения и все чаще требуют рендеринга страниц через обычные браузеры. Grass решила эту проблему, направляя запросы через миллионы домашних интернет-соединений, владельцы которых добровольно присоединились к сети и получают вознаграждение за свой вклад.


Multicoin говорит, что рынок не закладывает в текущую цену второе потенциально направление - продажа "доступа" для инференса ИИ Агентов / запросов

Если спросить модель о том, что компания объявила сегодня утром, задержан ли рейс или что именно сейчас написано на веб-странице, информации, хранящейся в весах модели, будет недостаточно. Ей необходимо найти источник, открыть соответствующую страницу и считать данные в реальном времени. Агент, выполняющий сложную задачу, может повторять этот процесс неоднократно, прежде чем сможет дать ответ.
Мы считаем, что в перспективе рынок поиска и извлечения информации непосредственно в процессе работы модели (на этапе инференса) может на несколько порядков превысить рынок данных для предварительного обучения.
Исходя из исторических цен на публичные API поисковых систем, даже малая доля такого объема запросов могла бы обеспечить годовую выручку в миллиарды долларов.

В последний раз OpenAI сообщала о показателе более 2,5 млрд сообщений в ChatGPT в сутки (данные на июль 2025 года), а число еженедельных пользователей с тех пор превысило 1 млрд. В 22% случаев взаимодействия с ChatGPT задействуются внешние инструменты; если исходить из того, что лишь 10% таких обращений приводят к платному поисковому запросу, это дает около 128 млрд запросов в год (или примерно 640 млн долларов при тарифе Brave — 5 долларов за 1000 запросов). Использование ИИ-агентов существенно увеличивает эти цифры: типичная задача в Gemini Deep Research предполагает выполнение около 80 поисковых запросов. Так, примерно 10 млн еженедельных пользователей Codex и ChatGPT Work, выполняющих по пять задач в неделю (по 20 поисковых запросов каждая), генерируют дополнительные 52 млрд запросов (около 260 млн долларов), а перевод всего 1% ежедневных сообщений в формат агентских задач исследовательского уровня увеличил бы общий объем до более чем 1 трлн запросов, что соответствует примерно 5 млрд долларов в год.

комментарий к статье Multicoin

https://x.com/dougsimp/status/2105103534559814014


Хорошо написано. Насколько значимо их структурное преимущество в плане затрат по сравнению с Exa, Parallel, Brave Search, Perplexity Search, Firecrawl и т. д.?

Низкая стоимость сбора данных не отменяет расходов на индексацию, хранение, ранжирование, рендеринг или выдачу результатов. Собранная страница может использоваться для множества последующих поисковых запросов, поэтому экономия на сборе данных распределяется (амортизируется) на весь этот объем, а не возникает заново при каждом запросе.

Какую долю в общих затратах их конкурентов составляют расходы на сбор данных?

Чисто гипотетически, допустим:

- Сбор данных составляет 30% от прямых затрат на сервис.
- Доступ через резидентные сети и расходы на пропускную способность — это половина затрат на сбор.
- Grass сокращает эту составляющую на 80%.
- Итоговая экономия на затратах сервиса составит 30% × 50% × 80% = 12%.

у условного Perplexity Search есть инфра индексации, а аналоги Grass ( Oxylabs / BrightData -поставщики прокси ) для них выступают партнерами по одной из составляющей этой инфры, которая нужна будет для ИИ-Агентного поиска

+ GRASS по сути работает в серой зоне, обходя блокировки владельцев сайтов

Cloudflare, 2025 год. Cloudflare обвинил Perplexity в скрытых краулерах, которые ротируют IP после запрета в robots.txt. Perplexity ответила, что Cloudflare приписал ей 3–6 млн запросов в день от стороннего облачного браузера BrowserBase, а сама Perplexity использует его меньше чем на 45 тыс. запросов в день.
Иск Reddit. Reddit утверждает, что SerpApi, Oxylabs и AWMProxy снимали контент Reddit из выдачи Google в обход защиты, и что Perplexity работала как минимум с одним из них. В июле 2026 года суд отказал Perplexity в прекращении иска, дело идёт дальше. Это пока обвинения, а не решение суда

Google закрывает свой API к 2027 году.
Reddit и некоторые другие крупные игроки тоже не делятся со своими данными.

скорее всего будет сценарий такой, что будет белая система через условный CF + владельцев сайтов - для покупки запросов ИИ-Агентов под сайты
но все равно останутся, те кто не будут продавать
и GRASS и подобные игроки будут актуальны
More from @web3_aggregator
  1. Oct 3, 2026Свежие активности дня 🟢Titan регистрация в WL Titan - биржа с приватной торговлей запусти…
  2. Oct 3, 2026Чет скипнули новость или я не видел в пабликах инфы, ещё 10 сентября Трамп пообещал каждом…
  3. Oct 3, 2026NFT минты Раз уж сумки укатываются - есть вариант поработать руками и повыбивать вайтлисты…
  4. Oct 3, 2026Нобелевеский лауреат по экономике Дарон Ачемоглу (который год назад предсказывал что эффек…
  5. Oct 3, 2026Короче, эти Revenue внатуре скамерами оказались Они щас у себя в твиттере пост опубликовал…
  6. Oct 3, 2026Если сливали ключи в MoG зайдите чекните кэшбэк https://playmog.xyz/
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →