На данный момент Gemini 2.5 Pro в AI Studio бесплатна в варианте браузерного UI, имеет режим thinking и контекстное окно в 1М токенов, что выгодно отличает эту топовую модель от её конкурентов.
С таким большим контекстным окном можно проверить: действительно ли читатели моих руководств умнеют, даже если они сами - AI. Полюбуйтесь на этот диалог:
https://aistudio.google.com/app/prompts?state=%7B%22ids%22:%5B%2216CwrytqjnGlo8OGnS9V1Wgs7Z8m6BOfx%22%5D,%22action%22:%22open%22,%22userId%22:%22115325060035114944424%22,%22resourceKeys%22:%7B%7D%7D&usp=sharing, https://drive.google.com/file/d/1pdiKZ8XVhJWn2GNSdprLA5Euly0Ya84z/view?usp=sharing
Я хотел сдаться на уговоры и составить наконец-то глоссарий по системному мышлению, поэтому поэкспериментировал немного и составил промпт для глоссария (причём в руководствах проверил — он таки работает!). Но потом я загрузил текст руководства и добавил "Надо составить глоссарий для Руководства. Вот инструкция для экспертной панели. Предложи её улучшение, исходя из характера и стиля Руководства". Дальше смотрите, что получилось: Gemini отказалась делать глоссарий, предложила вариант с навигатором понятий. А когда я предложил пройтись сверху вниз по всему тексту, опять-таки отказалась и предложила agile процедуру: "сначала по всему тексту возьмём важнейшие понятия, и только потом — все".
В OpenAI из топовых моделей 1М контекстное окно есть ещё у GPT-4.1, но там ещё и "исключительно высокое следование инструкциям", а также нет режима thinking. Поэтому там чтение руководства не даёт такого уж большого эффекта, а без thinking ещё и галлюцинации. Тем не менее, смотрите на тамошний вариант: инструкция по составлению глоссария была как-то улучшена, но никаких радикальных предложений — https://chatgpt.com/share/68564979-128c-8013-b94d-bf3cf8ce4a9d
Попробуйте брать наши руководства и работать с ними там, где есть большое контекстное окно (скажем, Руководство по системному мышлению берёт сразу 222000 токенов при загрузке, поэтому осмысленность работы с его полной версией появляется с 1М контекстного окна).
Конечно, чтобы проверять работу LLM, надо и самому знать содержание загружаемых руководств! А вопросы задавать не по улучшению самих руководств (это мой рабочий проект), а по вашим рабочим проектам, но с ответами от LLM с опорой на наставления руководств.
Post #25
544