Найдено 5 материалов

Навык — папка с файлом SKILL.md, которую модель подгружает, когда сочтёт нужным. Формату меньше года, а на публичных репозиториях GitHub уже почти четыре миллиона таких файлов, и половина из них — побайтные копии чужих. Замеры сходятся в неудобном: навык помогает не тем, что знает, а тем, что задаёт порядок действий. Курированный навык, выданный под задачу, поднимает долю решённых задач SkillsBench с 33,9 до 50,5 %, но как только условия приближаются к настоящим, выигрыш тает, а навыки, которые модель написала себе сама, опускают результат ниже, чем без навыков. Пятнадцать шагов по двадцати трём исследованиям и двенадцати документам: что сделать, на каком измерении держится каждый шаг и по какому признаку видно, что он сработал.
PDF | 49 стр.
Новинка399 ₽
Подробнее
Серверов десятки тысяч, главная угроза — отравленные описания инструментов, сильная модель подвох распознает, чем больше инструментов, тем глупее агент — за два года вокруг Model Context Protocol сложился слой уверенных представлений. Здесь каждое из тринадцати утверждений сведено с измерениями. Из 400 серверов, случайно вытянутых из официального реестра, рукопожатие прошли 195. Больше двух пятых удалённых серверов пускают без аутентификации, подтверждение перед вызовом спрашивают 37,2 % клиентских приложений, а сколько в природе серверов с отравленными описаниями, три попытки посчитать оценили от нуля до почти всех. Двадцать три исследования полными текстами и семнадцать первоисточников о самом протоколе, включая спецификацию ревизии 2026-07-28.
PDF | 40 стр.
Новинка399 ₽
Подробнее
Если собрать советы по работе с ChatGPT, которые ходят по сети, выйдет толстая тетрадь: задать роль, попросить думать по шагам, дать образец, попросить проверить себя. Если собрать работы, где эти советы проверили на людях с секундомером и контрольной группой, тетрадь станет тонкой. Это письмо коллеге по одиннадцати работам, прочитанным целиком: у каждого совета стоит, на что он опирается — на измерение, на слова производителя или ни на что. Самое неожиданное нашлось не в приёмах, а в людях: там, где задача выходила за пределы возможностей модели, люди с ней ошибались чаще, чем без неё, и писали при этом убедительнее.
PDF | 26 стр.
Новинка299 ₽
Подробнее
Колесо баланса, пирамида Франклина, SWOT для человека, кайдзен для себя, правило 80 на 20, матрица Эйзенхауэра, четыре темперамента — семь инструментов разобраны поимённо: откуда взялись, что о них известно и что из них стоит оставить. Двадцать одна рецензируемая работа, пятьдесят две темы с вердиктом по каждой и вывод, вынесенный в название: покупная программа «мышления роста» дала эффект 0,05, а план «если — то», написанный под свою ситуацию, прибавляет к одной лишь цели 0,65.
PDF | 44 стр.
Новинка399 ₽
Подробнее
Где языковые модели ускоряют работу, где незаметно замедляют её и что при этом происходит с вашим навыком. Двенадцать работ, из них шесть — эксперименты на людях с контрольной группой: только замеры того, что происходило с работой, когда доступ к модели давали и отбирали, а не впечатления.
PDF | 25 стр.
Новинка299 ₽
ПодробнееПоказано 1–5 из 5