English
联系我们
网站地图
邮箱
旧版回顾



性爱大师

2026,AI给数学家带来危机_我的网站

尼基塔第三季

A |     2026年,数学遭遇密集"AI攻城"。

B |                    7月20日,Anthoropic的一名员工Levent Alpöge在X.com上说,自己在看世界杯时,顺手用Fable 5找出了雅可比猜想的一个反例,在X上引起轩然大波,因为这是数学界的顶级“悬案”之一,人们用了87年试图证明它的正确性;华人数学家张益唐当年的博士论文题目正是与此有关,而论文的不顺又导致他后来多年以打杂为生。      上周(8月17日—21日)2026年半年报密集发布,A股共有194家上市公司接受机构投资者调研。                   Anthropic这个非正式的数学高光时刻,已经比对手晚得多。  从赚钱效应来看,约三成被调研公司股价上涨,其中鼎阳科技涨超35.4%,恒逸石化涨近24%,金禄电子涨超22%,尚太科技、瑞纳智能、华之杰、海油工程等8家公司涨超10%。K图 688627_0  精智达:半导体测试设备业务收入增长147.05%
  精智达(688627)上周接受197家机构投资者调研,机构重点关注该公司2026年上半年经营情况、产品业务最新进展、未来战略规划等方面。

C | 再往前推两个月,OpenAI和谷歌几乎是当面对决。据精智达披露,报告期内,该公司半导体测试设备业务延续高速增长态势,营收同比增长147.05%。2026年1月,该公司披露签订金额为13.11亿元(含税)的重大销售合同。                   5月20日,OpenAI 宣布:其内部一个通用推理模型,自主推翻了匈牙利传奇数学家保罗·埃尔德什(Paul Erdős)提出的"单位距离猜想"。

D | 这个问题已困扰了数学家整整80年。菲尔兹奖得主蒂莫西·高尔斯(Timothy Gowers)直言不讳地评价:“此前没有任何AI生成的证明能接近这个水准。

E | ”                    仅仅一天后,Google的DeepMind 以更大的规模还击。  在产品业务最新进展方面,精智达表示,公司围绕“存力、算力、运力、感知”四大核心赛道持续推动技术升级与产品迭代。                   他们设计的数学模型AlphaProof Nexus,自主解决了9道公开的Erdős难题,其中2道已经悬而未决长达56年。此外,它还解决了另外一些问题,每个问题的推理成本也低到仅为几百美元。在存储测试设备领域,公司取得18Gbps(比特率)超高速FT测试设备关键技术突破;在高端算力芯片测试设备领域,项目目标可实现最大6912路数字通道,通道带宽可达1.6Gbps;XR检测设备领域海外收入首次实现大幅增长,持续向海内外客户批量交付,同时获得国内头部ODM(原始设计制造商)厂商订单等。

F |   精智达在调研中表示,公司确立了存力、算力、运力、感知四大核心发展主线,以测试检测技术为核心,致力于打造半导体测试检测平台型企业。未来在存力领域,将依托半导体存储器测试设备及配套治具的完整产品线,为AI(人工智能)基础设施提供存储测试支撑;在算力领域,将持续推进高端算力芯片测试设备研发,打造专业化测试解决方案,助力AI算力核心环节的产业化验证。K图 300012_0  华测检测:海外业务营收占比提升至10%以上
  华测检测上周接待167家机构线上调研,其工业测试业务上半年实现营收7.15亿元,同比增长18.95%,增速较快。                   DeepMind高管Pushmeet Kohli宣布AlphaProof Nexus解决了数个问题丨X.com                    三家公司的成果,在数学界和大众舆论中都引起了轰动。对此,华测检测介绍原因称,增长动力包含外延并购与内生业务提升两部分,其中南非SafetySA与希腊Emicert并购项目为板块增长提供了重要助力。

G |   在调研中,华测检测进一步透露,公司去年完成三家重点海外企业并购,各标的整合有序推进,业务协同不断落地,海外业务增长较快,今年上半年海外业务营收占比提升至10%以上。                   能力飞跃                    要理解今年数学界的震撼程度,可以回看这条清晰的加速曲线。  上半年,华测检测消费品检测板块营收、毛利率同步提升。华测检测高管表示,消费品检测板块增长主要受益于出口市场回暖,轻工、玩具、纺织、电子科技等细分业务表现突出;同时抓住汽车电动化、自动驾驶机遇,汽车相关检测业务持续放量,进一步拉动营收及毛利改善。K图 301526_0  国际复材:特种电子布在收入中已有贡献
  国际复材上周接受142家机构调研,2026年上半年公司业绩大幅增长,对此,国际复材表示,业绩增长主要受益AI算力、高速通信、车载PCB(进程控制块)拉动高端电子布需求爆发,电子细纱及其制品量价齐升,同时公司主动优化产品结构,资源向高附加值产品倾斜,内部降本增效持续落地,降费控本工作显现成效。  据国际复材披露,2026年上半年,公司热固产品完成销售30.66万吨,热塑产品销售19.78万吨,风电产品(纱、布)销售12.8万吨,电子细纱销售4.19万吨,电子细纱布销售1.13亿米。                   2024年7月,DeepMind的AlphaProof在国际数学奥林匹克竞赛(IMO)中解出6道题中的3道非几何题,达到银牌水平。  在机构投资者看来,AI服务器、车载PCB、高速通信是当前高端电子布三大增量赛道,机构重点关注国际复材在这些领域的布局及进展。

H | 国际复材表示,目前低介电LDK二代产品已经进入国内外多家头部覆铜板厂商供应链,实现稳定批量供货;低膨胀LCTE产品已形成小批量供给,正在有序推进产能提升等相关工作;Q布产品仍处于研发阶段,力争2026年内完成中试项目建设投用。特种电子布在电子布业务收入中已占有一定比重。  国际复材分析,本轮电子玻纤高景气主要来自AI服务器、高速交换机、车载PCB带来的高端基材增量需求。供给端高端设备交付周期较长,高端产能短期释放有限,行业呈现结构性分化的格局,下半年行业供需、产品价格会受下游开工、同行产能投放设备到货节奏等多重变量影响。(文章来源:证券时报·e公司)。这是AI首次在IMO中获得奖牌级表现。注意,此时它解出的问题都有答案,不是未知、开放性的。                   2025年10月,OpenAI曾声称GPT-5解决了10道Erdős难题,但这一说法在几小时内就被公开驳斥:GPT-5并非原创求解,而是做了"超级文献检索",找到了此前罕为人知的已发表论文。                   2025年年末,DeepMind部署了智能体Aletheia。在Erdős问题数据库中,Aletheia挑选了700道进行尝试;它正确解决了13个问题,其中4道是新解答,另外9道又是“超级文献检索”成功了。                   而2026年5月至今的这三次突破,有了本质性不同:                    第一,问题份量重。Aletheia的研究者自己就承认,去年所解决的4道 Erdős 难题,大多冷门,有些可能从来没有专家认真尝试过。但此次OpenAI 所推翻的“单位距离猜想”,核心、知名,哪怕有Erdős本人为它悬赏却仍长期悬而未决,难度和地位都得到公认。                   Anthoropic Fable 5找出反例的雅可比猜想,被美国数学家、菲尔兹奖得主斯蒂芬·斯梅尔(Steve Smale)列入“18个21世纪的世纪数学难题”。虽然这次AI只是找到了三维空间中的一个反例、二维中猜想是否为真尚不得而知,但仍因问题难度大,而被许多数学家认为是AI的重要突破。

I |                    第二,更自主。

J | 之前AI解决数学问题是"半自主"的:AI生成候选方案,然后需要数学家人工筛选、修正细微错误。

K | 而OpenAI 5月的突破,是模型完全自主地生成了整个证明。

L | 更进一步地,谷歌的AlphaProof Nexus不再需要数学家给它做质检了。它利用了一种叫Lean的形式语言,自主完成了正确性检验。                   Fable 5的工作细节,现在我们还不得而知。

M |                    轰动新闻,离不开精心“设计”                    OpenAI所解决的那个问题是这样的:在一个平面上放 n 个点,那么距离恰好是1的点,最多能有多少对?数学家Erdős在1946年猜测,正方形网格的排列方式是最优解。

N |                    不管你会不会解这道问题,但我相信,你很容易看懂它。这也正是OpenAI新闻成功引发轰动的关键点之一。                             “OpenAI的数学团队里,有很了解数学研究的专业人士。这个团队显然是花了大量的时间,从那些尚未被解答的数学问题中,挑选哪个可能做得出来。从被挑选过的问题中,又着重精选几个最有可能出成果的、简单到大众也能听懂、数学家又要足够关注的问题”,北京大学国际数学中心副教授李欣意这样分析。                   “甚至他们要考虑到,证明也不能冗长,不能让数学家用上半年才能复核完毕。”                    Anthoropic Fable 5所提出的雅可比猜想反例,更是简洁到只有寥寥几行式子,很容易就被其他数学研究者验证。                   Levent最初的那条推文丨x.com                    是的,研究者们必须把“人类友好”考虑进去。                   AI现在还不能抛开人类                    当AI使用大语言模型写出一些“看起来很有道理”的推理的时候,它到底有没有犯错,是很难由它自己来确证的。

o |                    OpenAI使用的是一个通用推理模型。它接收到问题后,用自然语言(即人类能读懂的语言)生成了一条非常长的思维链,每个子Agent做一部分短小的自然语言论证、一环套一环,最后得出一个结果。                   但自然语言推理有一个天然的弱点:模型可能在推理链的某一步犯小错,最终酿成大错。

p | 所以OpenAI请来了9位顶级数学家对证明进行人工审查。这些数学家不仅验证了正确性,还大幅改进了原始证明,使之更简洁、更通用。Erdős问题数据库的维护者托马斯·布鲁姆评论道:"人类在讨论、消化、改进这个证明以及探索其后果方面,仍然扮演着关键角色。"                    DeepMind的AlphaProof Nexus在推理过程中,靠Lean语言暂时摆脱了“人”证明它对不对;人类只最后确认结果的数学意义。                   · 大语言模型会用 Lean 的形式化语言生成证明步骤;          · Lean编译器检查每一步是否成立;如果某一步不通过,Lean 返回错误信息,模型据此修正;          · 循环往复,直到成功。

q |                    全部用Lean去验证这件事情,看起来很美妙,但还远远没有到完全能够实操的程度。简单说就是:Lean语言严格而冗长,人类很难直接写或读懂,需要“翻译”,但“翻译现有数学定理”这一基础建设,也还差得很远。

r |                    AI的数学能力高于人类吗?                    先说结论:AI目前并不比人类更聪明。它只是没有学科壁垒、没有权威偏见,然后“大力出奇迹”。                   AI证明了Erdős是错的、雅可比猜想有反例,而不是像大多数人那样,面对传奇数学家的一个古早猜想,沿着心理惯性,试图证明他是对的。它又比那些试图寻找反例的人,更有耐心反复尝试。

s |                    AI是个“通才”,这同样令人类自叹弗如。5月份OpenAI解决的单位距离问题属于几何领域,成功的关键是,它从代数领域的数论中引入了一个看似无关的工具。要知道,现代数学高度分工,研究组合几何的数学家通常不会深入探究数论,反之亦然。

t | 这两个领域之间的距离,就像让一个心脏外科医生去想到用免疫学的方法治病。

u |                    不过,AI现在缺乏在新方向上的洞察和探索能力。李欣意做了一个这样的比喻:                    “如果人类的数学知识可以比喻成一个有凹有凸的多边形,外部是未知部分,那么一流的数学家可能在一个尖角上把边界拓展到远处;像希尔伯特这样的伟大数学家,甚至在好几个方向都走得很远;而广大的数学工作者大多数时候做的事情,是把凹进去的部分补齐——数学上叫做‘取凸包’。

v | ”                    “现阶段‘大新闻’里的数学AI,也不过是把知识变成知识的凸包,而不是在未知方向上探索得更远。”                    黄色的部分,是AI的“补齐”短板                    假如有朝一日, AI 掌握了往外走的能力,那可能确实就真的是全面超越了人类。                   数学家预见到重重危机                    2026年6月2日,来自15所大学的16位研究者发布了《莱顿人工智能与数学宣言》。这份宣言获得了国际数学联盟(IMU)的正式支持,陶哲轩、彼得·舒尔茨等知名数学家也公开签署。                   宣言并不反对使用AI,也鼓励数学家了解新兴技术。它担心的是,在用AI更快、更多地生成成果的过程中,数学界一些基本价值观可能被破坏。                   最直接的问题是,AI能够快速生成大量“看起来正确”的证明,其中却可能藏着很难发现的错误。AI“完成”一个证明只需要几小时;认真审查它,却要花几周甚至更长。有能力审稿的数学家极其有限,AI成果井喷会导致同行评议体系“消化不良”;如果大量的AI推理直接以预印本甚至新闻稿的形式发表,则是严重的误导,并挤占了那些真正有价值的发现的空间。                   这个担忧甚至马上被验证了。就在几天以前,OpenAI在发布GPT 5.6 Sol的关头,发布新闻稿,宣布解决了一个尘封50年的数学问题。

w | 但这个成果并没有得到外部数学专家的确认。                   OpenAI也没有说明,在“智能体解答问题”和“最终产出3页结果”之间,还有多少人类劳动丨OpenAI                    另一个问题是成果归属。数学AI建立在大量的前人研究成果之上,但在输出时,往往无法为贡献者合理署名,这对数学家不公平。部分训练数据还涉及未经许可使用论文和数据库,由此产生新的版权争议。

x | 以及,如果数学家协同AI产生新的数学,那么这一成果究竟是属于人类还是AI?                    《宣言》还提出了一个更隐蔽的威胁:科技公司可能开始影响数学界的导向。AI公司倾向于搞那些“容易做”的问题,而非“有深远意义”。在大学预算紧张的背景下,这可能改变激励机制,变相鼓励研究人员与科技公司进行不对等的合作。

y | 如果不加以控制,可能破坏现有的招聘、资助和认可机制,威胁研究人员的自主性,甚至影响数学研究本身的范围和深度。                   作者:Luna          题图:Sally Caulwell。

Current article:http://df45y30.ningshunsaotuiqiao.shop/list_r82246/uy9b2ed.html

Published on:11:28:29


专题推荐

相关新闻


© 1996 - 我的网站 版权所有   联系我们

地址:北京市三里河路52号 邮编:100864