Сверка двух CSV: ключ, а не номер строки
Сверка двух CSV: ключ, а не номер строки
Просите ИИ не «посмотреть отличия», а выполнить проверяемую сверку через Python. После сортировки одна и та же запись окажется в другой строке — сравнение по позиции даст ложные расхождения.
Факт: в pandas merge(..., how="outer", indicator=True, validate="one_to_one") сохраняет ключи из обоих файлов, отмечает их наличие в каждом и проверяет уникальность ключей с обеих сторон.
Как применить: 1. Укажите ключ: например, invoice_id. Для строк счёта может понадобиться составной ключ: номер счёта + номер позиции. Задайте поля для сравнения. 2. Попросите остановиться при пустых или повторяющихся ключах, а не удалять дубли молча. 3. Получите отдельные списки: только в A, только в B, изменённые поля у совпавших ключей. Сохраните CSV расхождений и код сверки.
Готовый prompt: Сверь A.csv и B.csv в Python. Ключ: invoice_id; поле: status. Загрузи ключ как строку. При пустом/дублирующемся ключе остановись и покажи проблему. Иначе выполни outer merge с indicator=True и validate="one_to_one". Для общих ключей сравни status, считая два пропуска равными. Выдай CSV расхождений и код. Исходники не меняй. Если не можешь выполнить код, явно скажи это — не придумывай результат.
Ловушка: _merge="both" означает совпадение ключа, не всех полей! pandas также соединяет пустые ключи друг с другом — поэтому проверка пустот нужна до merge.
Источник: https://pandas.pydata.org/docs/reference/api/pandas.merge.html Каталог GPU Verum-AI: https://verum-ai.uz

