The invisible messages, which instruct large language models to use telltale phrases in a peer-review report, are effective in catching artificial-intelligence misuse but also erode trust, some say.