第10周行业和学术资讯推送
本周行业资讯
《Decrypt|This AI Was Trained Only on Pre-1930 Text. We Asked It About Hitler, Stocks, and the Future》: https://decrypt.co/366015/talkie-1930-ai-model-pre-1931-training-hitler-stocks
导读一个站在二战爆发前夕、对现代技术革命一无所知且从未见过互联网的大模型,会怎样理解希特勒、股市与未来世界?这篇报道聚焦新近亮相的Talkie-1930。这是一款仅以1931 年 1 月 1 日之前出版的书籍、报纸、科学期刊、专利申请、判例法等语料进行训练的开源语言模型,是迄今为止训练规模最大的复古语言模型。文章通过与它进行密集对话,展示其在历史判断、技术想象和投资建议上的奇异表现。
Talkie-1930大模型的访问链接(无需注册,支持英文直接对话): https://talkie-lm.com/chat
《晚点LatePost|详解 DeepSeek V4:Infra 巨鲸 “四连击”,百万上下文走进现实》: https://mp.weixin.qq.com/s/GBaPrVWMGpV7Z6bVuEXhSA
《第一财经商业数据中心|2026年的零售业:谁在崛起,谁在崩塌》: https://www.cbndata.com/information/295242
《财经杂志|特别报道:AI时代的就业真相》: https://mp.weixin.qq.com/s/1MQZKfvX_q4phrE9VE6zZQ
《集智俱乐部|AI意识综述》: https://mp.weixin.qq.com/s/7Q3u1QziUQYBD7wLN6sc_A
本周学术资讯
Dillon, E. W., Jaffe, S., Immorlica, N., & Stanton, C. T. (2026). Shifting work patterns with generative AI (NBER Working Paper No. 33795). National Bureau of Economic Research. https://doi.org/10.3386/w33795
导读生成式AI真能改变知识工作者的日常工作方式,还是只是在个别任务上带来有限提速?这篇论文基于Microsoft与66 家大型企业开展的6个月现场实验,追踪7137名知识工作者在获得Microsoft 365 Copilot 使用权限前后的办公软件行为,并采用随机分配和DID设计识别影响。研究发现,真正使用Copilot的员工主要在邮件处理上节省时间,每周Outlook使用时间明显下降,也减少了部分非正常工作时间。但会议时间、文档写作、邮件回复线程、会议数量和文档产出并未出现明显变化。这表明,现阶段AI在组织早期部署中更像个人任务提效工具,而不是自动引发工作流程重组的组织技术。
Luettgau, L., Cheung, V., Dubois, M., Juechems, K., Bergs, J., Symes, L., Davidson, H., O’Dell, B., Kirk, H. R., Rollwage, M., & Summerfield, C. (2026). People readily follow personal advice from AI but it does not improve their well-being [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2511.15352
导读人们向AI询问健康、职业和亲密关系问题时,真的会把AI的建议落实到现实生活中吗?这篇论文基于英国代表性样本开展纵向随机对照试验,让6474名参与者与GPT-4o、Llama-3.3-70B 或 Gemini 3 Pro进行20分钟对话,并在2—3周后追踪建议采纳和幸福感变化。研究发现,实验组中很高比例的参与者报告采纳了 AI 建议,即便建议涉及较高后果,采纳率仍然不低。但接受个人建议并未比谈论兴趣爱好带来持续幸福感改善。
Davidson, T., Halperin, B., Houlden, T., & Korinek, A. (2026). When does automating AI research produce explosive growth? Feedback loops in innovation networks (NBER Working Paper No. 35155). National Bureau of Economic Research. https://doi.org/10.3386/w35155
导读如果AI能自动化AI研究本身,经济增长是否会进入爆炸式加速?这篇论文构建带有创新网络的半内生增长模型,把软件研究、硬件研究、一般研究、最终产出和资本积累纳入同一反馈系统,分析研究自动化何时能克服思想生产递减收益和部门瓶颈。论文发现,自动化研究会同时激活技术反馈循环和经济反馈循环。前者来自软件、硬件等研究部门相互促进,后者来自更高产出继续融资更多研究。校准结果显示,硬件研发自动化尤其关键,因为其历史递减收益较弱。
Li, X., & Zhou, X. (2026). The cognitive benefit of a window view. Journal of Economic Behavior & Organization, 241, Article 107358. https://doi.org/10.1016/j.jebo.2025.107358
导读高考考场里一个能看到窗外的座位,会不会影响学生的考试表现?这篇论文利用中国某县2019年高考行政数据,依托省级教育部门随机分配考场和座位的制度,比较坐在无遮挡窗边、遮挡窗边和教室中间位置的学生成绩。研究发现,只有能看到窗外的座位显著提高成绩,遮挡视野的窗边座位没有类似效果。这种成绩提升还转化为更高的一流本科院校录取概率。论文进一步用教师评语识别注意力维持困难学生,发现他们受益更明显,说明窗外视野可能通过注意力恢复改善高压认知表现。
Webb, C., & Lupton, D. (2026). Confronting the gatekeepers of experimental political science [Working paper]. APSA Preprints. https://doi.org/10.33774/apsa-2024-7wq88-v2
导读政治学实验研究中那些看似提高质量的审稿规范,是否正在把实验研究变成资源充足者的游戏?这篇论文分析2010—2021年AJPS、APSR和JOP三大政治学期刊中的实验与非实验文章,比较作者机构排名、博士毕业机构排名以及实验研究中样本类型、多实验设计和预注册情况。作者认为,反便利样本、要求多实验和单独要求实验预注册这三种规范缺乏充分科学基础,却显著提高研究成本。经验分析显示,顶刊实验研究更集中于精英机构学者。