← Назад к ленте Открыть источник ↗

Тестирование Jev Skill Suggestion против моделей Claude: 26 навыков, 10 промптов и по 3 запуска на каждый. 🦀

Тестирование Jev Skill Suggestion против моделей Claude: 26 навыков, 10 промптов и по 3 запуска на каждый. 🦀

Jev — 90% точности, медиана 330 мс
Haiku — 80%, 1,24 с
Sonnet / Opus / Fable — 100%, 2,2–4,5 с

То есть Jev немного жертвует точностью, но принимает решение в 4–14 раз быстрее, при этом список навыков вообще не занимает контекстное окно.

Полный эксперимент: https://claude.ai/artifact/SDysJzxN9ZR5S1nge4C87C

Ещё из канала

Все посты канала
Claude Opus 5.5 уже вышла и обходит Fable 5.1 и GPT-6 Astra в большинстве бенчмарков. 🦀 1 час назад GPT-6 Sol и GPT-6 Luna готовятся к выходу. Модели уже находятся на финальном этапе подготовки. 3 часа назад Семейство Qwen4 впервые анонсировали официально. 5 часов назад Jev сейчас очень быстро набирает популярность. 7 часов назад 30–40% годовых у среднего бизнеса. А дальше 10 часов назад Google открыла исходный код AX — своего оркестратора для ИИ-агентов. 12 часов назад

Ещё по теме

🤔 Чем занимается второй сооснователь AI Factory — который не в Higgsfield Theedinorogblog Отрицательный экономический рост! mikheenkovnews 😱 Попала в миграционную тюрьму из-за фейков консультанта по ВНЖ Theedinorogblog

Совет: в ленте включайте только непрочитанное — так вы не смешиваете уже просмотренное с новыми постами.

Общение и предложения