Кажется, скоро мы вообще перестанем выбирать нейросети.
Ещё недавно нормальным было открыть список моделей и думать: для этого запроса взять одну, для кода другую, для какой-нибудь сложной аналитики третью. Но сейчас всё больше сервисов пытаются убрать этот выбор от пользователя.
Например, OpenRouter недавно обновил автоматический роутер: он сам определяет тип задачи — код, математика, поиск информации, планирование и так далее — и выбирает подходящую модель. В августе похожую штуку запустил Ramp.
И мне кажется, это довольно очевидное будущее массового ИИ. Большинству людей вообще не хочется разбираться, какая модель сейчас топ-1 на очередном бенчмарке. Им нужен нормальный ответ.
В России, кстати, уже идут примерно в ту же сторону. В Алисе система сама
выбирает модель под конкретный запрос: спросили что-то простое — отвечает быстрая модель. Нужно учесть кучу условий, что-то посчитать, разобрать несколько документов или составить план — сама подключает режим «Эксперт». Пользователю ничего выбирать руками необязательно.
Но чем проще всё выглядит для пользователя, тем сложнее становится система под капотом. Там уже не только разные модели и роутинг между ними, но и харнесс, который работает с контекстом и инструментами.
И ещё один важный слой — люди, которые знают отдельные области лучше самой нейросети.
Чтобы модель становилась сильнее в медицине, финансах, праве или инженерии, недостаточно просто дать ей ещё больше текстов. Нужны специалисты, которые действительно разбираются в предмете: могут отличить хороший ответ от убедительно звучащей ерунды, найти ошибку в рассуждении и показать, как такую задачу решает профессионал.
У Яндекса, например, до конца года хотят привлечь до 1000 таких экспертов из разных областей. Они будут готовить примеры ответов для обучения, оценивать результаты моделей и проверять, насколько корректно те решают профессиональные задачи.
И мне нравится этот парадокс: для нас нейросети постепенно становятся проще — задаёшь вопрос и всё. А внутри, чтобы этот ответ появился, работает всё более сложная система из моделей, инструментов и людей, которые пока разбираются в отдельных кусках мира лучше этих моделей.
Возможно, через несколько лет вопрос «а какую модель ты используешь?» будет звучать примерно так же странно, как «а какой поисковый алгоритм у тебя сейчас включён?»