Новая модель рассуждений Salesforce и Nvidia — именно то, чего должны бояться ИИ-лаборатории
Новая модель ИИ под названием Koa — одно из крупнейших объявлений Salesforce на этой неделе на гигантской технологической конференции Dreamforce. Koa — первая модель компании с возможностями рассуждения, созданная на базе модели Nemotron с открытыми весами от Nvidia. Две компании вместе дообучили Koa, чтобы она превосходно справлялась с задачами, связанными с продажами, маркетингом и поддержкой клиентов.
Koa — яркий пример того, как потребности корпоративного мира в ИИ расходятся с тем, что предлагают передовые лаборатории. Лаборатории, разрабатывающие проприетарный ИИ, предпочли бы, чтобы компании напрямую загружали в их модели и агентов файлы, код, промпты и отзывы, тратя на это миллионы.
Но с помощью этой модели Salesforce предлагает своим корпоративным клиентам:
- альтернативу закрытым передовым моделям с открытыми весами
- модель, обученную выполнять конкретные рабочие задачи (а не решать нерешаемые математические задачи)
- модель, которая не загружала никаких реальных данных клиентов и поэтому не может раскрыть их другим
- модель, которая помогает сократить расходы на ИИ, поскольку использует меньше токенов для выполнения той же работы
- модель, запросы к которой можно автоматически направлять через ИИ-«шлюз» в зависимости от потребностей
- а также модель, которая соблюдает все требования клиента к данным и безопасности, встроенные в Salesforce.
Koa будет предоставляться как альтернатива другим моделям, которые Salesforce предлагает на своей платформе Agentforce, где клиенты создают агентов для выполнения рутинных задач, таких как ответы на вопросы службы поддержки или планирование встреч.
«Мы создали множество небольших языковых моделей для конкретных задач, которые входят в портфолио Agentforce, — рассказал TechCrunch Джайеш Говиндараджан, исполнительный вице-президент Salesforce по ИИ. — Но для рассуждений нам всегда приходилось полагаться на поставщиков передовых моделей. До сих пор».
До появления Koa, если агенту требовалось рассуждать в процессе выполнения длительной или многоэтапной задачи, такие промпты через ИИ-шлюз Agentforce направлялись к передовой модели вроде Claude или ChatGPT (системе, которая определяет, какая модель обрабатывает тот или иной запрос).
«Одна из причин, по которой мы не сделали этого раньше — не обучили собственную передовую модель корпоративного уровня, хотя всегда хотели, — заключалась в отсутствии предварительно обученной базовой модели, на которой можно было бы начать работу. До появления Nemotron не существовало предварительно обученной суверенной американской модели, которая, во-первых, была бы доступна, во-вторых, соответствовала бы передовому уровню, а в-третьих, имела бы четко подтвержденное происхождение данных. Мы понятия не имеем, на каких данных обучается Qwen», — сказал Говиндараджан, имея в виду популярную китайскую модель с открытыми весами, разработанную Alibaba.
Дообучение такой модели означает превращение универсальной системы в модель, хорошо разбирающуюся в знаниях о продажах и поддержке клиентов; для этого Salesforce и Nvidia не использовали никаких реальных данных клиентов Salesforce. Вместо этого они создали синтетические данные, имитирующие модели поведения клиентов.
«Мы фактически смоделировали среду обслуживания клиентов с участием виртуального специалиста по работе с клиентами — от раздраженных клиентов, звонящих в центр обслуживания, до специалиста по продажам, пытающегося закрыть сделку», — описал Говиндараджан.
Koa призвана лучше справляться с рабочими задачами, которые клиенты Salesforce хотят поручить агенту, — и обходиться дешевле с точки зрения потраченных токенов, — чем передача тех же задач Claude или ChatGPT.
«Благодаря Nemotron у нас есть уникальная архитектура для инференса, позволяющая эффективно использовать токены, — рассказала TechCrunch Кари Энн Бриски, вице-президент Nvidia по программному обеспечению для генеративного ИИ для предприятий. — Это своего рода триада необходимых компонентов: суверенный ИИ, время до получения первого токена и эффективное рассуждение — все это с точки зрения токеномики».
Однако Salesforce не отказывается полностью от Anthropic или OpenAI. Компания только что объявила о партнерстве с Anthropic под названием ClaudeForce, которое позволяет компаниям использовать Claude в качестве интерфейса ИИ, в то время как их данные остаются в системе учета Salesforce, защищенные ее инфраструктурой.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.