Контекстное окно — это не память
Модель не помнит прошлый разговор и не читает контекст равномерно. Разбираю, что она видит на самом деле и как из этого следуют вполне практические правила.
Длинные разборы того, что я собирал сам: устройство, места отказа и выводы, которые пережили практику.
Модель не помнит прошлый разговор и не читает контекст равномерно. Разбираю, что она видит на самом деле и как из этого следуют вполне практические правила.
Один и тот же текст на русском обходится в заметно большее число токенов, чем на английском. Разбираю, откуда берётся разница, во что она обходится и что с ней делать.
Почему просьба «внедрить ИИ» не превращается в задачу, что приходит ей на замену и как выглядит проверка, которую контур может провалить.
Ответственность не делится с инструментом. Разбираю рабочую модель: владелец результата, журнал действий, точка принятия — и что писать в регламенте, чтобы это не осталось словами.
Почему семантический поиск не спасает плохо устроенную базу: где теряется качество, что делает нарезка, зачем нужен реранкер и как измерять, стало ли лучше.
Где ускорение от кодовых агентов реальное, где мнимое, почему граница проходит по стоимости приёмки и какой навык становится дефицитным.
Признаки, по которым процесс лучше оставить человеку, почему упрощение обычно выигрывает у интеграции и как считать стоимость владения до начала работ.