Sakhanda Wire
NVDA $238.90 +2.12% MSFT $525.18 +1.48% GOOGL $346.47 +0.86% META $741.90 +1.90% AMZN $251.40 -0.05%
← Към новините

Представяме Together Link: безплатен CLI, който стартира отворени модели като Kimi K3 и GLM 5.3 в Claude Code, Codex и OpenCode

Together AI пусна Together Link — безплатен CLI инструмент с MIT лиценз, който в момента е в бета версия. Той свързва кодиращите агенти, които разработчиците вече използват, с отворени модели, хоствани в Together AI. Поддържаните инструменти включват Claude Code, Claude Desktop, Codex, ChatGPT Desktop, OpenCode и Pi. Идеята е проста: запазвате средата, сменяте модела и намалявате сметката.

Може ли да бъде внедрен още днес? Да. Инсталира се с една команда на macOS или Linux и изисква единствено API ключ за Together. Инструментът е в бета версия, така че командите, маршрутизирането и списъкът с модели може да се променят.

Проблемът, към който е насочен

Кодиращите агенти често изпращат всяка задача към един и същ премиум модел — от корекция на един ред до цялостно пренаписване. В своята публикация за старта екипът на Together посочва, че инженерните организации харчат от десетки хиляди до милиони долари месечно за затворени модели. Тезата му е, че отворените модели са намалили значително разликата. Kimi K3 и GLM 5.3 са предназначени за сложни задачи по програмиране. GLM 5.3 Flash и DeepSeek V4.1 Flash покриват ежедневните задачи.

Как работи Together Link

Инсталацията се извършва с една команда:

Копиране на кодаКопираноИзползвайте друг браузър
curl -fsSL https://link.together.ai/install | bash

Инсталаторът добавя Bun, ако е необходимо, и поставя командите в ~/.local/bin. Изпълнете togetherlink, за да отворите стартов панел, или стартирайте инструмент директно с togetherlink claude, togetherlink codex, togetherlink opencode или togetherlink pi. Работят и преки пътища като tclaude.

Според официалната документация не се стартира локален прокси сървър или демон. Всеки инструмент комуникира директно с хоствания шлюз на Together. Терминалните агенти получават временна конфигурация за всяко стартиране, която се премахва при приключване на сесията. Claude Desktop и ChatGPT Desktop използват отделни профили, които могат да бъдат възстановени. С команди като togetherlink chatgpt off се връщате обратно.

Автоматичният маршрутизатор

По подразбиране сесиите използват виртуален модел auto. Според публикацията за старта маршрутизаторът прочита първата задача на всяка сесия. Бързите корекции се насочват към бързи и евтини модели, докато сложните проблеми получават възможностите на водещите модели. При наличие на Anthropic API ключ той маршрутизира между Opus 5.5 и GLM 5.3. Без такъв ключ маршрутизира между GLM 5.3 и GLM 5.3 Flash. Маршрутизирането се извършва веднъж на сесия, така че кеширането на подсказките продължава да работи.

Пътят през Opus се прилага само за Claude Code и Claude Desktop, като разходите се начисляват към вашия Anthropic акаунт. Codex, OpenCode, Pi и ChatGPT Desktop винаги използват модели на Together. За да фиксирате един модел, поставете флага преди името на инструмента: togetherlink --main zai-org/GLM-5.3 claude.

В Claude Code менюто /model свързва различните нива с отворени модели. Opus използва Kimi K3, Fable използва GLM 5.3, Sonnet използва GLM 5.3 Flash, а Haiku използва DeepSeek V4.1 Flash.

Модели, цени и разписки

Документацията изброява Kimi K3, GLM 5.3, GLM 5.3 Flash и DeepSeek V4.1 Flash, всеки с контекст от 1 млн. токена. На страницата на продукта Kimi K3 е посочен на цена от $3.00 за вход и $15.00 за изход, а GLM 5.3 — $1.40 за вход и $4.40 за изход. DeepSeek V4.1 Flash и MiniMax M3 са посочени на цена от $0.30 за вход и $1.20 за изход. Актуалните тарифи са публикувани на страницата с цените на Together.

Таксуването се извършва чрез съществуващия ви Together ключ — с плащане според потреблението или чрез пакети с кредити. При излизане от всяка сесия се показват общият брой токени и сумата в долари. В Claude Code лентата на състоянието показва приблизителния разход до еквивалентната цена за Opus. Изпълнението на togetherlink usage --last 7d показва разходите, проследени от шлюза, за всички сесии.

Екипът на Together също отбелязва, че осигурява най-големия дял от токените на OpenRouter за DeepSeek V4.1 Flash (40.8%), GLM 5.3 Flash (28.2%) и Kimi K3 (23.1%) към 30.09.2026 г.

Together Link спрямо най-близките алтернативи

ФункцияTogether LinkOpenRouterClaude Code RouterOllama launch
НастройкаИнсталиране с една curl команда, след което togetherlink claudeПроменливи на средата в shell профилаНастолно приложение или npm CLIollama launch claude
Локален прокси сървърНе, хостван шлюзНе, директна връзкаДа, локален шлюз на порт 3456Локален сървър или директна връзка с Ollama Cloud
АгентиClaude Code, Claude Desktop, Codex, ChatGPT Desktop, OpenCode 2, PiРъководства за Claude Code, Codex CLI, OpenCode, Cursor и други10 агента, включително Claude Code, Codex, OpenCode и PiClaude Code, OpenCode, Claude и ChatGPT Desktop (macOS)
Автоматично маршрутизиранеАвтоматичен маршрутизатор, опционално повишаване към Opus 5.5Модел openrouter/autoМаршрутизиране на правила с резервни вариантиНяма документация
Проследяване на разходитеРазписка за всяка сесия и отчет за използването за 7 дниТабло за активността и скрипт за лентата на състояниетоИзползване на токени и приблизителни разходи в дневницитеНяма документация
МоделиПодбрана селекция на TogetherКаталогът на OpenRouterВсеки конфигуриран от вас доставчикЛокални модели и модели на Ollama Cloud
Операционна системаmacOS, LinuxНавсякъде, където работи Claude CodemacOS, Windows, LinuxСвързването с настолното приложение е за macOS
ЛицензMIT, безплатенХоствана услугаMIT, безплатенБезплатен локално, за облака е необходим API ключ

Предимството на Together Link е подбраният път с една команда и вградени разписки за спестяванията. Claude Code Router предлага по-широк контрол върху доставчиците, но работи с локален шлюз, който управлявате вие.

Интерактивно обяснение

Основни изводи

  • Една команда за инсталация свързва 6 съществуващи агента с отворени модели в Together AI.
  • Автоматичният маршрутизатор по подразбиране избира между GLM 5.3, GLM 5.3 Flash и, по желание, Opus 5.5.
  • Together твърди, че спестяванията надхвърлят 50%, а спрямо сесии, използващи изцяло Opus 5.5, са между 50 и 80%.
  • Не се стартира локален прокси сървър, а обичайните конфигурационни файлове на агента остават непроменени.
  • Безплатен и с MIT лиценз, но по време на бета версията е ограничен до macOS и Linux.

Разгледайте техническите подробности и GitHub. Всички заслуги са за изследователя на този проект. Също така, не се колебайте да ни последвате в Twitter и не забравяйте да се присъедините към нашия 150k+ ML SubReddit и да се абонирате за нашия бюлетин. Чакайте! В Telegram ли сте? Сега можете да се присъедините към нас и в Telegram.

Имате нужда да си партнирате с нас за популяризирането на вашето GitHub хранилище, страница в Hugging Face, продуктово издание, уебинар и т.н.? Свържете се с нас

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от MarkTechPost на

Прочетете оригинала в MarkTechPost ↗

Текстът и изображенията са собственост на MarkTechPost и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини