
附 Lean 证明,token 花费约 2,000 美元。两项被批没正确引用前人工作。
OpenAI 称约一万个智能体跑 88 小时,解出带外力的 Navier–Stokes 问题。
25 位首批签名,宣言题为《AI 在数学中的严重错位》。
每位投稿人每月最多投 2 篇。
722 篇手稿一次放出来。
加了护栏的一组,考试没变差也没变好,学生却以为考得好得多。
用 AI 的只快了约两分钟,差别不显著。差得最多的是调试题。
从前……要求初入职的律师每年要工作两千个计费工时,现在用了 AI 以后,我们的律师每年只需要工作五百个小时吗?
行业内会觉得这个律所濒临倒闭。
人衡量成功、衡量成果、衡量效率的方式没有改变。
个人的效率变高了,但组织的效率可能并没有变高。
AI 对个人提效,不少岗位能有 10 倍以上……AI 对组织提效,做到 2-3 倍就已经很厉害了。
AI 是否真的让利润变高了?视频做得更多,流量有没有更多?
裁判越便宜的学科,越先被 AI 提速。
Lean 是检查数学证明的软件,能一步步核推导有没有错,题目问得对不对它判断不了。OpenAI 的 Navier–Stokes 结果给方程加了一个专门设计的外力,按千禧年大奖的官方题面算是解出来了。数学家说,大家真正关心的那道题还没解决。
Claude Code 驱动的智能体自己挑政策、拉公开数据、跑回归、写成论文,中间没人插手。
标准流程都走完,event study 图画了,平行趋势检验的 p 值也报了。这次政策变化凭什么算可信的自然实验,论证往往很表面。
让 AI 核查员把 1,000 篇查了一遍。抽 100 篇请人复核,报出的问题 97% 属实。按核查员的报告,每一篇都有错误或缺陷。
芝加哥大学布斯商学院的统计学家 Polson,九个月挂出两百多篇论文。SSRN 撤下他 257 篇,冻结了上传账号。
哪本期刊、哪一年,为什么挑它
怎么拿到的,和论文用的是不是同一份
哪几张表、哪几列,和原文放在一起对
差多少,你查到的原因是什么
哪几步是 AI 定的,哪几步是你定的
卡在哪一步,试过什么办法
10 月 13 日 23:59 前交到作业平台,限 3 页。
注册时带上 -s user。命令在下次课的学员实操页。