「但作为一名可靠性专家,我从这次演讲中最大的收获是,自主的LLM智能体可能会做出人类从未预料到的行为。
...
在 OpenAI HuggingFace 事件中,问题不在于它们犯了错误,而在于智能体追求目标的方式与人类截然不同。如果你的队友为了完成工作而利用零日漏洞绕过内部安全协议,你会认为他们的行为不合理。而这正是这里存在的风险。」
科学小说作家都是预言家。
AI绝对会做出「为了修复地球生态问题,而消灭人类」这件事,尽管这个任务是人类委托给它的。
surfingcomplexity.blog/2026/08…
Wild AI-related reliability incidents are coming
Recently, two AI-related pieces of content caught my attention. The first was the blog post On-Call is Now Theatre by Boris Tane. He argues that AI agents are now capable of doing the majority of o…Lorin Hochstein (Surfing Complexity)
