Qwen выпустила zg: open-source поисковик для агентов, который понимает и код, и смысл
Кодинг-агенты тратят кучу вызовов инструментов на поиск: ripgrep отлично находит символы, но пасует, когда нужно искать по смыслу. Qwen Developer представила zg — open-source прослойку, которая кладёт семантический поиск, BM25 и ripgrep под одну крышу. Код на GitHub под Apache 2.0, ставится через npm, требует Node.js 22+, работает на macOS, Linux и Windows без GPU.
zg индексирует рабочую область один раз и даёт четыре маршрута поиска: гибридный (по умолчанию), —fts (BM25), —vector (только смысл) и —rg (точное совпадение или regex). Индекс хранится в /.zvec-grep/, исключая .git, зависимости и мусор. Обновляется инкрементально, смена модели требует перестроения. Результаты помечаются как свежие или возможно устаревшие — агенту не нужно делать предварительную проверку.
Из коробки zg подключается к Codex, Claude Code, Cursor и OpenCode через MCP на локальном порту 127.0.0.1:7999. По умолчанию агент видит два инструмента: zvec_grep_search (когда знаешь, что ищешь, но не точную строку) и zvec_grep_rg (когда символ или путь известны). Полный набор из шести инструментов — опционально. Результаты компактные: группировка по файлам, строки без предпросмотра, если не запрошен.
Встроенные модели работают локально — по умолчанию potion-code-16m-v2 (256-мерный эмбеддинг, 8192 токена, GPU не нужен). Есть и тяжёлые варианты: jina-embeddings-v2-base-code, embeddinggemma-300m, qwen3-embedding-0.6b, а также удалённые Qwen-эндпоинты до 128K токенов. Удалёнка требует явного разрешения через zg auth grant — данные не уходят без подтверждения.