陶哲轩掀桌:25位菲尔兹奖得主联名警告AI,别再刷榜数学了昨天(9月11日),AI圈和数学圈同时炸了。
陶哲轩、邓煜、彼得·舒尔茨等25位菲尔兹奖得主联合发布了一份声明——《人工智能在数学中的严重错位》(A Severe Misalignment of AI in Mathematics)。陶哲轩把声明全文同步发在个人博客上(原文见文末),截至发稿前,已有2415名支持者。
通篇没点名OpenAI,但所有人都读懂…
图形学大佬、前微软全球研究合伙人童欣加盟,Meshy 下一步要做实时互动世界作者|周一笑
微信|smiletalker
计算机图形学研究者童欣最近加入 AI 3D 生成公司 Meshy,出任首席科学家。
童欣 1999 年获得清华大学博士学位后加入微软亚洲研究院,在那里工作了 25 年,曾领导网络图形组,并担任全球研究合伙人(Partner Research Manager)。研究范围横跨纹理合成、材质建模、真实感渲染、三维动画和…
GCSA Agent 在 CyberGym 取得 91.3% 成绩 跻身全球领先 AI 网络安全智能体行列 - GCSAGCSA Agent 在全球高难度真实漏洞基准测试中展现自主漏洞分析与 PoC 生成能力
GCSA Agent 在全球高难度真实漏洞基准测试中展现自主漏洞分析与 PoC 生成能力。
香港,2026 年 8 月 29 日 —— 全球网络安全联盟(Global Cybersecurity Alliance,GCSA)今日宣布,GCSA Agent 在 Cybe…
OpenAI正式进入千亿资产安全战场:EVMbench发布,智能合约审计范式生变2026年2月18日,OpenAI与加密投资机构Paradigm联合发布了一款名为EVMbench的基准测试工具。根据HEAL Security的报道,这套工具旨在评估AI代理在以太坊虚拟机环境中发现、修补和利用智能合约漏洞的能力,其背后是价值超过1000亿美元的开源加密资产安全需求。这条新闻在AI圈并未激起太大水花,但在区块链安全领域,它被视为一个历史性…
Coinbase 财报后暴跌 15%,Benchmark 却高呼买入:五个被忽视的关键信号撰文:White55,火星财经
当 Coinbase 股价周五暴跌 15% 时,市场目光聚焦在财报的黯淡数字上:总收入环比下降 26%,交易收入骤降 39%,加密货币现货交易量较第一季度萎缩超 30%。然而在恐慌抛售中,Benchmark 分析师马克·帕尔默带领的团队在周一报告中写下了截然不同的建议:「这些运营指标只是噪音,逢低买入非常明智」——他们不仅重…
营收增速≠价值创造,Benchmark 合伙人过滤 AI 泡沫的投资指南撰文:蓝莓豆浆
编辑:伊凡
近日,根据外媒报道,美国财政部正在就Benchmark Capital向中国公司 Manus AI 的投资进行调查。美国财政部正在调查该交易是否受美国对华投资规则的约束。新规于今年1 月生效,限制了美国对中国人工智能、半导体和量子计算领域的某些投资,或在某些情况下要求投资者将此类交易告知财政部。
不过,这并不妨碍这家在Uber、…Yandex电竞团队签下ATF为新offlaner,原选手DM移至替补席Techub News 消息,Yandex电竞团队近日宣布阵容调整,签下选手ATF作为新的offlaner,同时将原选手DM移至替补席。此次变动可能影响团队在未来赛事中的竞争策略与动态。(Crypto Briefing)Vitalik Buterin 测试本地 AI 模型 Qwen3.8-Flash,称其速度已堪日常使用Techub News 消息,以太坊联合创始人 Vitalik Buterin 发文表示,本地人工智能(AI)已接近能够处理大量日常任务。他在自己的笔记本电脑上运行了阿里巴巴的 Qwen3.8-Flash-Next 模型,并公布了速度测试结果。该模型完全在本地设备上运行,无需连接云端服务器。
Buterin 使用的笔记本电脑搭载了 AMD Strix Halo 芯片,该设计允许 CPU 和 GPU 共享高达 128GB 的内存,使其能够容纳以往需要服务器硬件才能运行的大型模型。他发布的测试速度显示,对于简短提示,模型能以舒适的阅读速度回应;但对于数万字的超长文档,输出速度会减慢。
Buterin 还强调了本地 AI 在隐私方面的优势,因为请求不会发送给任何服务提供商。他建议,对于更复杂的工作,可由本地模型处理其能力范围内的部分,并将敏感细节剥离后再将问题传递给更强大的云端系统,以减少个人信息泄露。 (BeInCrypto)Nunchux AI 发布 VC-Attention 内核,加速视频扩散 Transformer 推理Techub News 消息,Nunchux AI 发布 VC-Attention,一种无需训练的低比特注意力内核,专为视频扩散 Transformer 设计。它同时解决值量化误差和 softmax 阶段缓慢两个问题,通过 V-Smooth 处理值异常值和 ExpCast-FP8 优化 softmax 瓶颈。
在 B200、H200、RTX 5090 等 GPU 上的测试显示,该内核能实现 1.13 倍至 1.70 倍的端到端加速,注意力计算速度提升最高达 3.58 倍。在 Wan2.2 等开源视频生成模型上,其保真度优于 SageAttention2 等先前方法。(MarkTechPost)Prior Labs 发布表格基础模型 TabPFN-3.5,在多个基准测试中排名第一Techub News 消息,Prior Labs 发布了其表格基础模型 TabPFN-3.5 的最新版本。该模型无需针对特定数据集进行训练或调优,即可在单次前向传播中完成表格预测。Prior Labs 报告称,该模型在七项表格基准测试中均排名第一。
一项独立演示显示,TabPFN-3.5 在默认设置下,其预测性能超越了 2015 年一场著名 Kaggle 竞赛的获胜解决方案。该模型在 Otto 竞赛的私有排行榜上获得了 0.375 的分数,优于原获胜方案的 0.382。模型仅使用合成数据进行预训练,未接触过 Otto 或任何 Kaggle 数据集。
该模型系列包括开放权重的 TabPFN-3.5(2.2 亿参数)和 TabPFN-3.5-Fast(8400 万参数,速度提升高达 6 倍),以及仅限 API 和企业使用的 TabPFN-3.5-Plus 和 TabPFN-3.5-Thinking。生产使用需要 Prior Labs 的 API 或商业许可。(MarkTechPost)Nums AI 发布表格基础模型 Causilo,在 TabArena 单模型中排名第一Techub News 消息,Nums AI 发布了用于分类和回归的预训练表格基础模型 Causilo。该模型提供 scikit-learn 接口、Apache-2.0 许可代码及 Hugging Face 上的预训练权重。在 TabArena 基准测试中,Causilo 在分类和回归任务上的 Elo 分数均为单模型最高。
Causilo 是一个上下文学习模型,调用 fit 不会更新预训练权重。它仅使用合成数据进行预训练,未使用 TabArena 数据集。输入支持 NumPy 数组或 pandas DataFrame,可处理分类特征和缺失值。
在官方 TabArena 评估中,Causilo 整体 Elo 为 1794 分,领先于 Google Research 的 TabFM 和 LG AI Research 的 EXAONE Tabular 等模型。在 ScoringBench 的回归模型评估中,Causilo 1.0.1 在 CRPS、R² 和 RMSE 指标上均排名第一。(MarkTechPost)美联储与日本央行本周或同步加息,为2006年以来首次Techub News 消息,美联储与日本央行(BOJ)预计将在本周48小时内相继加息,为2006年以来三大央行(美联储、欧洲央行、BOJ)首次在同一窗口期收紧货币政策。美联储将于周三公布决议,期货市场定价加息25个基点的概率超80%;BOJ则预计在周五行动,CNBC调查显示89%的经济学家预期其将加息25个基点至1.25%。
市场关注此举将收窄美日利率差距,并影响套利交易与第四季度风险偏好。分析师对BOJ加息幅度存在分歧,野村研究所经济学家认为特朗普政府已排除日本政府干预BOJ加息的可能性,而部分经济学家则预期BOJ可能按兵不动。
(BeInCrypto)巴西 Banco Master 银行倒闭案波及最高法院,法官莫赖斯涉利益冲突Techub News 消息,巴西 Banco Master 银行于 2025 年 11 月倒闭,导致储户和保险公司损失数十亿美元。该案现已波及巴西最高法院及总统选举。最高法院将于 9 月 15 日审议是否对法官亚历山大·德·莫赖斯展开调查,因其与银行所有者丹尼尔·沃卡罗有过接触,且其妻子律所曾与 Banco Master 签订价值 1.3 亿雷亚尔的合同。
巴西央行此前因严重流动性危机和违规行为清算该银行,存款担保基金已向约 72.2 万名客户支付约 402 亿雷亚尔。该银行曾提供高达巴西 CDI 基准 140% 的存款凭证收益率,以快速扩张。
此案已进入巴西大选议程。参议员弗拉维奥·博索纳罗呼吁罢免莫赖斯,并称投票给现任总统卢拉即支持此丑闻。博索纳罗本人也因与该银行相关的电影融资面临质疑。(BeInCrypto)Sakana AI 提出 PC-ALM 算法,可训练千层网络Techub News 消息,Sakana AI 研究人员提出了一种名为“增强拉格朗日预测编码”(PC-ALM)的新算法,作为反向传播的替代方案。该算法能在保持层间更新局部化的同时,恢复与反向传播对齐的信用信号。研究团队报告称,使用该算法成功训练了高达1000层的残差MLP网络,在MNIST数据集上的性能与反向传播相比差距在约2个百分点内。
PC-ALM 是一种训练方法,而非模型,目前仅在小型图像基准测试中进行了验证。该团队提供了基于 JAX 的 MIT 许可参考实现代码,可在 CPU 上运行并复现论文中的宽度-深度网格实验结果。(MarkTechPost)马斯克称 Grok 5 可能实现通用人工智能 (AGI)Techub News 消息,xAI 创始人埃隆·马斯克在 X 平台发文表示,其下一代模型 Grok 5 预计将实现通用人工智能 (AGI)。马斯克称,即将完成训练的 Grok 4.8 会有明显改进,Grok 4.9 有望达到 Astra 或 Fable 级别性能,而 Grok 5 可能会“超越一切”。
马斯克表示,Grok 4.7 与 Anthropic 的 Opus 5.0 大致相当,在多模态性能方面仍需改进。他近日支持 Anthropic 联合创始人关于放缓 AI 能力开发的呼吁,而其自身 AGI 时间表的预测也突显了行业在追求突破与控制风险之间的张力。(BeInCrypto)韩国央行警告 AI 芯片热潮已成金融稳定问题Techub News 消息,韩国央行报告指出,该国经济正因 AI 芯片需求而繁荣,2026 年上半年名义 GDP 增长 21.9%,其中近 70% 的增长来自半导体。三星电子和 SK 海力士等半导体巨头贡献了主要增长,但央行认为该行业规模已大到构成金融稳定问题,而非单纯由基本面驱动的股市上涨。
报告警告,全球 AI 基础设施支出可能在 2027 或 2028 年放缓,将系统性冲击韩国经济。同时,流动性过剩正流入房地产和杠杆产品,推高泡沫风险,而传统制造业、青年就业和国内需求依然疲弱。
若韩国芯片生产受阻,全球市场将立即感受到冲击,英伟达和 AMD 等公司股价与韩国芯片产出紧密相关,AI 主题基金和半导体指数将面临快速重定价。(BeInCrypto)昨天(9月11日),AI圈和数学圈同时炸了。 陶哲轩、邓煜、彼得·舒尔茨等25位菲尔兹奖得主联合发布了一份声明——《人工智能在数学中的严重错位》(A Severe Misalignment of AI in Mathematics)。陶哲轩把声明全文同步发在个人博客上(原文见文末),截至发稿前,已有2415名支持者。 通篇没点名OpenAI,但所有人都读懂…
