Sakhanda Wire
NVDA $238.90 +2.12% MSFT $525.18 +1.48% GOOGL $346.47 +0.86% META $741.90 +1.90% AMZN $251.40 -0.05%
← До новин

Представляємо Together Link: безплатний CLI для запуску відкритих моделей на кшталт Kimi K3 і GLM 5.3 у Claude Code, Codex та OpenCode

Together AI випустила Together Link — безкоштовний CLI з ліцензією MIT, який наразі перебуває в бета-версії. Він підключає програмувальних агентів, якими розробники вже користуються, до відкритих моделей, розміщених на Together AI. Серед підтримуваних інструментів — Claude Code, Claude Desktop, Codex, ChatGPT Desktop, OpenCode і Pi. Ідея проста: залишити оболонку, замінити модель і зменшити рахунок.

Чи можна розгорнути його вже сьогодні? Так. Він встановлюється однією командою на macOS або Linux і потребує лише API-ключа Together. Це бета-версія, тому команди, маршрутизація та список моделей можуть змінюватися.

Проблема, яку він вирішує

Програмувальні агенти часто надсилають кожне завдання до тієї самої преміуммоделі — від виправлення одного рядка до повного переписування. У своєму дописі з нагоди запуску команда Together зазначає, що інженерні організації щомісяця витрачають від десятків тисяч до мільйонів доларів на закриті моделі. Її аргумент полягає в тому, що відкриті моделі значною мірою скоротили розрив. Kimi K3 і GLM 5.3 орієнтовані на складні завдання з програмування. GLM 5.3 Flash і DeepSeek V4.1 Flash охоплюють повсякденні завдання.

Як працює Together Link

Встановлення виконується однією командою:

Копіювати кодСкопійованоВикористати інший браузер
curl -fsSL https://link.together.ai/install | bash

Інсталятор додає Bun, якщо це потрібно, і розміщує команди в ~/.local/bin. Виконайте togetherlink, щоб відкрити лаунчер, або запустіть інструмент безпосередньо за допомогою togetherlink claude, togetherlink codex, togetherlink opencode чи togetherlink pi. Також працюють скорочення на кшталт tclaude.

Згідно з офіційною документацією, локальний проксі або демон не запускається. Кожен інструмент безпосередньо взаємодіє з розміщеним Together шлюзом. Термінальні агенти отримують тимчасову конфігурацію для кожного запуску, яка видаляється після завершення сеансу. Claude Desktop і ChatGPT Desktop використовують окремі профілі, які можна скасувати. Команди на кшталт togetherlink chatgpt off повертають попередні налаштування.

Автоматичний маршрутизатор

За замовчуванням сеанси використовують віртуальну модель auto. Згідно з дописом про запуск, маршрутизатор аналізує перше завдання кожного сеансу. Швидкі виправлення спрямовуються до швидких і недорогих моделей, а складні проблеми отримують можливості передових моделей. За наявності API-ключа Anthropic маршрутизація відбувається між Opus 5.5 і GLM 5.3. Без нього — між GLM 5.3 і GLM 5.3 Flash. Маршрутизація виконується один раз за сеанс, тому кешування промптів продовжує працювати.

Шлях Opus доступний лише для Claude Code і Claude Desktop, а оплата стягується з вашого облікового запису Anthropic. Codex, OpenCode, Pi та ChatGPT Desktop завжди залишаються на моделях Together. Щоб зафіксувати одну модель, розмістіть прапорець перед назвою інструмента: togetherlink --main zai-org/GLM-5.3 claude.

У Claude Code меню /model зіставляє рівні з відкритими моделями. Opus працює на Kimi K3, Fable — на GLM 5.3, Sonnet — на GLM 5.3 Flash, а Haiku — на DeepSeek V4.1 Flash.

Моделі, ціни та квитанції

У документації перелічено Kimi K3, GLM 5.3, GLM 5.3 Flash і DeepSeek V4.1 Flash — кожна з контекстом обсягом 1 млн токенів. На сторінці продукту зазначено ціну Kimi K3: $3,00 за вхідні та $15,00 за вихідні токени, а GLM 5.3 — $1,40 за вхідні та $4,40 за вихідні. DeepSeek V4.1 Flash і MiniMax M3 вказані за ціною $0,30 за вхідні та $1,20 за вихідні токени. Актуальні тарифи доступні на сторінці цін Together.

Оплата здійснюється за допомогою наявного ключа Together — за моделлю оплати в міру використання або через пакети кредитів. Після завершення кожного сеансу відображаються загальні показники токенів і витрат у доларах. У Claude Code у рядку стану поруч із приблизною вартістю Opus показуються орієнтовні витрати. Виконання команди togetherlink usage --last 7d відображає витрати, відстежені шлюзом, за всі сеанси.

Команда Together також зазначає, що станом на 30.09.2026 забезпечує найбільшу частку токенів OpenRouter для DeepSeek V4.1 Flash (40,8%), GLM 5.3 Flash (28,2%) і Kimi K3 (23,1%).

Together Link у порівнянні з найближчими альтернативами

ФункціяTogether LinkOpenRouterClaude Code RouterЗапуск Ollama
НалаштуванняВстановлення одним curl, потім togetherlink claudeЗмінні середовища у профілі оболонкиДесктопний застосунок або npm CLIollama launch claude
Локальний проксіНі, розміщений шлюзНі, пряме підключенняТак, локальний шлюз на порту 3456Локальний сервер або пряме підключення до Ollama Cloud
АгентиClaude Code, Claude Desktop, Codex, ChatGPT Desktop, OpenCode 2, PiПосібники для Claude Code, Codex CLI, OpenCode, Cursor та інших10 агентів, зокрема Claude Code, Codex, OpenCode, PiClaude Code, OpenCode, Claude і ChatGPT Desktop (macOS)
Автоматична маршрутизаціяАвтоматичний маршрутизатор, опційне підвищення до Opus 5.5Модель openrouter/autoМаршрутизація на основі правил із резервними варіантамиНе задокументовано
Відстеження витратКвитанція для кожного сеансу та звіт про використання за 7 днівПанель активності та скрипт для рядка стануВикористання токенів і оцінки витрат у журналахНе задокументовано
МоделіДобірка TogetherКаталог OpenRouterБудь-який налаштований вами провайдерЛокальні моделі та моделі Ollama Cloud
ОСmacOS, LinuxДе завгодно, де працює Claude CodemacOS, Windows, LinuxПідключення десктопного застосунку доступне на macOS
ЛіцензіяMIT, безкоштовнаРозміщений сервісMIT, безкоштовнаБезкоштовно локально, для хмари потрібен API-ключ

Перевага Together Link — добірний шлях із запуском однією командою та вбудованими квитанціями про економію. Claude Code Router пропонує ширший контроль над провайдерами, але працює через локальний шлюз, яким потрібно керувати.

Інтерактивне пояснення

Головні висновки

  • Одна команда встановлення підключає 6 наявних агентів до відкритих моделей на Together AI.
  • Стандартний автоматичний маршрутизатор обирає між GLM 5.3, GLM 5.3 Flash і, за потреби, Opus 5.5.
  • Together заявляє про економію понад 50%, а також про економію 50–80% порівняно із сеансами, що повністю працюють на Opus 5.5.
  • Локальний проксі не запускається, а звичайні файли конфігурації агента залишаються недоторканими.
  • Сервіс безкоштовний і має ліцензію MIT, але під час бета-тестування обмежений macOS і Linux.

Ознайомтеся з технічними деталями та GitHub. Уся подяка належить досліднику цього проєкту. Також підписуйтеся на нас у Twitter і не забудьте приєднатися до нашого сабреддіту про машинне навчання зі 150 тисячами+ учасників та підписатися на нашу розсилку. Стривайте! Ви є в Telegram? Тепер ви також можете приєднатися до нас у Telegram.

Потрібно співпрацювати з нами для просування вашого репозиторію GitHub, сторінки Hugging Face, випуску продукту, вебінару тощо? Зв’яжіться з нами

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням MarkTechPost

Читати оригінал на MarkTechPost ↗

Текст і зображення належать MarkTechPost і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини