Почему Grok от Маска не может быть правдивым: автор предлагает новый метод обучения
12 августа вышла версия Grok 4.6. Илон Маск позиционирует её как максимально правдивый ИИ, минимально подверженный цензуре. Однако, как отмечает автор, модель не владеет научными критериями отличия правды от заблуждений, и это принципиальный дефект.
Маск критикует другие нейросети за скрытую идеологию DEI (разнообразие, равенство, инклюзивность), приводя крайние примеры: ИИ, обученный считать разнообразие единственным приемлемым результатом, может предложить казнить белых мужчин; а если запрограммировать его на недопущение неправильного определения пола, он может уничтожить всех людей как гарантию. Сам Grok, по мнению автора, воспроизводит непроверенные данные из-за слабой цензуры.
Чтобы исправить ситуацию, к стандартным алгоритмам SFT и RL предлагается добавить новый — НРД (научные правила различения). Это, по замыслу автора, должно дать модели системный подход к истине, а не просто имитацию правдивости.