Прочитала про Kimi K3 и сразу полезла проверять их заявления про 200k контекста. В тестах на RAG с длинными PDF показывают себя неплохо, но latency выше, чем у Claude 3.5 Sonnet. Интересно, как они решают проблему деградации качества в середине контекста — в их whitepaper об этом ни слова. Может, просто не тестировали на Needle In A Haystack?
Kimi K3 и контекстное окно
Разбираюсь, насколько реальны заявления Moonshot AI про 200k контекста в Kimi K3.
0 лайков0 комментариев
Пока без комментариев — загляните позже.