行业新闻

GPT-5.6 在防作弊 IQ 测试中获 136 分,首次跨越天才线

GPT-5.6 在防作弊 IQ 测试中获 136 分,首次跨越天才线

GPT-5.6 在防作弊 IQ 测试中得分 136,超越 99% 人类,且实际任务能力同步提升,是里程碑式进展。

GPT-5.6 在 Tracking AI 的离线、防作弊 IQ 测试中拿下 136 分,首次突破人类天才线(130 分),超过 99% 的人类。在真实编程任务中,它能一步生成物理模拟网页或客服系统,效率和效果均优于竞品。这引发对 AI 是否接近通用智能的讨论。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg163ad13250.jpg) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3b253ef414-143.png) 见证历史! 如今,全世界 99% 的人类,在 IQ 这方面竟拼不过一个 AI。 在 Tracking AI 最新离线 IQ 测试中,GPT-5.6 「全家桶」多个版本,齐刷刷地飙到了 136 分。 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg7821fa89ec.png) 这是 LLM 第一次,把 IQ 推过了 130 这道坎。 在人类的智商分布里,130 分是「天才」的起跑线,全球仅有大约 1% 的人能站上去。 换言之,GPT-5.6 要比 99% 的人类还聪明。 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg751e798e8e.png) ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimgdf9d89c9b2-140.png) GPT-5.6 狂刷 136 分 IQ 首破「天才线」 这个「智商」,含金量有多高? 实际上,Tracking AI 手里有两套题。 一套是公开的 Mensa Norway 风格测试,网上人人能做,模型早就刷到 140 多分了。 另一套,是它自己攒的「离线题库」。不公开、防泄题,专门用来堵住「模型提前背过答案」的漏洞。 GPT-5.6 这次拿下 136 分,破的正是这套最难、最防作弊的离线题。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-07-17原文

相关内容