Впервые столкнулся с проверочным барьером модели Zhipu
Сначала задача состояла лишь в переводе с китайского на английский Node.js-приложения, преобразующего mermaid в изображение; это чистый инструмент, и задача заключалась только в переводе. На данный момент в процессе использования модели Zhipu я уже столкнулся со следующими проблемами: 1. Крайне низкие ограничения параллелизма, чем больше нужно использовать, тем ниже параллелизм 2. Низкая скорость генерации токенов 3….
Categories:
Сначала задача состояла лишь в переводе с китайского на английский Node.js-приложения, преобразующего mermaid в изображение; это чистый инструмент, и задача заключалась только в переводе. На данный момент в процессе использования модели Zhipu я уже столкнулся со следующими проблемами:
- Крайне низкие ограничения параллелизма, чем больше нужно использовать, тем ниже параллелизм
- Низкая скорость генерации токенов
- Многократные вызовы инструментов заходят в бесконечный цикл
- Контроль рисков, влияние контроля рисков не документировано
- Барьер для чувствительного контента, не определено, какой контент считается чувствительным В версии glm4.5 я рекомендовал тарифные планы Zhipu, и никак не ожидал, что опыт использования с тех пор постоянно ухудшался. Постоянно подвергаешься маркетингу, а затем тратишь деньги на тестирование, впустую расходуя немало времени. Учитывая масштабную перепродажу ресурсов Zhipu и хаотичные меры ограничения трафика в критической ситуации, проблемы с плохим опытом, вероятно, сохранятся еще какое-то время. Я планирую посмотреть, как развивается Zhipu, через год, и в течение года не буду верить никаким рекомендациям о Zhipu.

