Cohere CEO Aidan Gomez(艾丹·戈麦斯):企业 AI 的规模化边界、合成数据与后 Transformer 时代撰文:Techub News 整理
导语
2025 年 4 月,Transformer 架构论文的八位作者之一、知名 AI 公司 Cohere 的联合创始人兼 CEO Aidan Gomez(艾丹·戈麦斯)做客由 Redpoint Ventures 制作的播客节目《Unsupervised Learning》。在这场长达 51 分钟的深度对话中,Gomez…
Google 首席科学家 Jeff Dean(杰夫·迪恩)与 Transformer 之父 Noam Shazeer(诺姆·沙泽尔):25 年 AI 之路与 AGI 蓝图撰文:Techub News 整理
导语
2025 年 2 月,知名播客主持人 Dwarkesh Patel 邀请到了 Google 的两位传奇工程师——首席科学家 Jeff Dean(杰夫·迪恩)和 Transformer 架构共同发明人 Noam Shazeer(诺姆·沙泽尔)进行了一场深度对话。两人均在 Google 工作了近 25 年,是塑造现代计…
Cohere CEO Aidan Gomez(艾丹·戈麦斯):Transformer 架构八年未变,AI 的未来在于企业应用撰文:Techub News 整理
导语
2017年,一篇名为《Attention is All You Need》的论文横空出世,其提出的 Transformer 架构彻底改变了人工智能的发展轨迹,开启了生成式 AI 的浪潮。八年后的2025 年 6 月,这篇论文的八位作者之一、当时还是一名大三本科生的 Aidan Gomez(艾丹·戈麦斯)已成长为估值…
Celestica:市场刚刚给投资者送上了一份价值 110 亿美元的“大礼”尽管 Celestica Inc.(CLS)近期财报表现超预期,而且整个市场也从 7 月底低点开始反弹,但随着投资者消化公司 8 月份的增发,Celestica 股价仍然持续承压。具体而言,公司在本季度以每股 310 美元的价格发行了超过 1,110 万股新股,募集资金总额接近 35 亿美元。
不过,公司近期与 Advanced Micro Devices…
那个最"不缺钱"的AI公司,也要上市了今天路透社丢出一条消息:DeepSeek已经请了中信证券当辅导机构,筹备在科创板IPO,计划年内正式启动上市流程。
DeepSeek和中信证券都没回应。但这事儿的可信度不低——中信证券是券商一哥,上市辅导又是A股的规定动作,请了谁,基本就是板上钉钉在推进了。
有意思的是,这家公司曾经是全行业最"佛系"的一个。
两年前:不融资,不上市
2024年底DeepS…
Google DeepMind 研究副总裁 Noam Shazeer(诺姆·沙泽尔):「大语言模型想要什么?」撰文:Techub News 整理
导语
在2025 年 9 月举行的全球顶尖芯片会议 Hot Chips 2025 上,Transformer 论文《Attention Is All You Need》的联合作者之一、Google DeepMind 研究副总裁 Noam Shazeer(诺姆·沙泽尔)发表了主题为「AI 下一阶段预测」的开场演讲。作为深度…
当具身处在它的 Bert 时代,GPT 时刻不会凭空发生具身大脑走向 “大一统”。
文丨江思远
北京人形大模型负责人鞠笑竹说,他们过去一段时间的训练工作里,频繁出现 “Aha Moment”——这让他看到了具身迈向 AGI 终局的可能性,让北京人形坚定了一种 “快速迭代” 的 “体系化” 的技术攻坚打法。
这种底气既来自于对自身模型团队工作的自信,同样也源于对身处快速发展期的具身技术发展规律的认知——越是早期,…
AI是人类发明的,还是发现的2026.08.09 · 硅谷 Alan Walker
这不是文字游戏。一样东西是被造出来的还是被找到的,决定了它归谁、听谁的、以及谁该为它负责。
California Avenue · Zombie Café · 早上七点
芯片是人造的,代码是人写的,公司是人开的。所以 AI 当然是人类发明的 —— 大多数人到这里就不往下想了。
但同样的逻辑放到别的地方…
Cohere CEO Aidan Gomez(艾丹·戈麦斯):Transformer 永生、开源昂贵,以及民主联盟的 AI 主权战撰文:Techub News 整理
导语
2026 年 6 月,Transformer 架构奠基性论文《Attention Is All You Need》的联合作者之一、AI 初创公司 Cohere 的联合创始人兼 CEO Aidan Gomez(艾丹·戈麦斯)做客知名科技媒体人 Eric Newcomer 的播客节目。在这场长达 20 多分钟的深度对话…Turkcell,2025财年Form 20-F年度报告提交美国证券交易委员会土耳其通信企业Turkcell(纽约证券交易所代码:TKC)宣布,已于4月17日向美国证券交易委员会提交了截至2025年12月31日的会计年度Form 20-F年度报告。此次披露是美股上市海外企业向投资者定期公开业务现状、财务业绩及风险因素等的例行程序。
公司提交的Form 20-F包含完整的审计财务报表。投资者可通过Turkcell投资者关系网站在线查阅…瑞典首相乌尔夫·克里斯特松因选举失利宣布辞职Techub News 消息,瑞典首相乌尔夫·克里斯特松在选举失利后宣布辞职。目前,由玛格达莱娜·安德松领导的左翼反对党联盟预计将组建新一届政府。(BBC News)Affirm推出基于Transformer的机器学习模型用于实时信贷审批Techub News 消息,美国金融科技公司 Affirm 宣布推出基于 Transformer 架构的机器学习模型,用于实时信贷审批。该 AI 驱动的承销模型旨在重新定义信用风险评估,有望提高先买后付(BNPL)行业的批准率和利润率。
(Crypto Briefing)纽约联邦法官拒绝 Susquehanna 冻结涉嫌内幕交易案 1 亿美元资金请求Techub News 消息,纽约联邦法官驳回了 Susquehanna 冻结近 1 亿美元资金的请求,这些资金与数十名交易者有关,他们被指控在中国宣布打击跨境交易平台前利用内幕信息获利。(Crypto.news)Vitalik Buterin 测试本地 AI 模型 Qwen3.8-Flash,称其速度已堪日常使用Techub News 消息,以太坊联合创始人 Vitalik Buterin 发文表示,本地人工智能(AI)已接近能够处理大量日常任务。他在自己的笔记本电脑上运行了阿里巴巴的 Qwen3.8-Flash-Next 模型,并公布了速度测试结果。该模型完全在本地设备上运行,无需连接云端服务器。
Buterin 使用的笔记本电脑搭载了 AMD Strix Halo 芯片,该设计允许 CPU 和 GPU 共享高达 128GB 的内存,使其能够容纳以往需要服务器硬件才能运行的大型模型。他发布的测试速度显示,对于简短提示,模型能以舒适的阅读速度回应;但对于数万字的超长文档,输出速度会减慢。
Buterin 还强调了本地 AI 在隐私方面的优势,因为请求不会发送给任何服务提供商。他建议,对于更复杂的工作,可由本地模型处理其能力范围内的部分,并将敏感细节剥离后再将问题传递给更强大的云端系统,以减少个人信息泄露。 (BeInCrypto)HTX Research 发布报告分析股票关联 Memecoin 市场结构与风险Techub News 消息,HTX Research 发布题为《股票关联 Memecoin:发行、流动性与新兴 AMM 栈》的报告,系统研究了 Robinhood Chain 上线后出现的新资产类别。这类 Memecoin 直接与代表 NVDA、TSLA 等股票的代币配对,结合了公开股权价格发现、加密市场关注度与 AMM 流动性。报告指出其短期增长逻辑成立,但持久性取决于四个条件能否同时满足。
报告指出,股票关联 Memecoin 是一种二阶股权敞口,股票代币提供一阶价格锚定,而 Memecoin 则交易围绕该股票的文化、事件和情绪,波动性常远超标的股票。其价值捕获不仅限于 Memecoin 本身,交易者的单笔订单可能为路径上的多个资金池产生费用。
报告拆解了市场评论中引用的超过 100,000% 的 APY 数据,指出这是由短期观察窗口、交易量骤增、较小的 TVL 基数以及复利外推造成的错觉。报告提出了更稳健的测试指标——费用覆盖倍数,只有该倍数大于 1 才表明做市风险得到了补偿。HTX Research 提出了四个将决定此类 Memecoin 能否从链上实验演变为持久市场结构的关键问题。 (NewsBTC)谷歌推出 Retrieve-for-Train 扩散检索器,查询效率提升 12 至 20 倍Techub News 消息,谷歌研究院发布全新检索框架 Retrieve-for-Train(R4T),旨在解决推荐系统需返回多样化结果集而非单一最佳匹配的问题。R4T 使用强化学习学习查询扩散策略,并将其蒸馏成一个小型扩散模型,可在单次推理中生成全部检索方向,使查询扩散效率提升 12 至 20 倍。
该框架解决了通用大语言模型在执行查询扩散时的两大问题:近义坍塌(产生过于相似的子查询)和延迟过高。其通过三阶段流程实现:首先训练一个查询扩散语言模型,然后合成监督数据,最终训练一个参数为 5390 万的扩散变换器模型来直接生成目标嵌入集合。
在 Polyvore 时尚搭配数据集和专有音乐数据集上的测试显示,基于 Gemma3-4B 的 R4T 框架在开放检索质量上优于最佳采样法,其生成的子查询多样性从零样本的 56.0 提升至 76.8。该方法无需在推理时重复调用大模型,显著降低了成本与延迟。(MarkTechPost)Nunchux AI 发布 VC-Attention 内核,加速视频扩散 Transformer 推理Techub News 消息,Nunchux AI 发布 VC-Attention,一种无需训练的低比特注意力内核,专为视频扩散 Transformer 设计。它同时解决值量化误差和 softmax 阶段缓慢两个问题,通过 V-Smooth 处理值异常值和 ExpCast-FP8 优化 softmax 瓶颈。
在 B200、H200、RTX 5090 等 GPU 上的测试显示,该内核能实现 1.13 倍至 1.70 倍的端到端加速,注意力计算速度提升最高达 3.58 倍。在 Wan2.2 等开源视频生成模型上,其保真度优于 SageAttention2 等先前方法。(MarkTechPost)Snap 推出 AI 助手 Specs Intelligence,可连接数字账户管理任务Techub News 消息,Snap 推出名为“Specs Intelligence”的新 AI 助手,该助手可连接用户的其他数字账户,协助处理工作任务、跟踪旅行信息等事务。Snap 将其定位为“预见性 AI 服务”,旨在帮助用户管理当日需关注事项,以推进长期目标。
Specs Intelligence 将与 Snap 首款面向消费者的增强现实眼镜 Specs 一同推出,但目前也已以预览形式在 iOS 平台上提供。用户同样可与该助手进行对话交互。(The Verge)苹果计划2029年推出搭载M8 Ultra芯片的AI服务器Techub News 消息,苹果正在研发一款AI服务器,将采用其Mac台式机中的高性能M系列Ultra芯片。据The Information报道,该企业服务器将提供两种配置,分别搭载两颗或四颗未来的M8 Ultra芯片。该项目据称在一年前启动时获得了新任CEO John Ternus的支持。
该计划与苹果Mac mini和Mac Studio在AI开发者及公司中销量激增的现状相吻合,这些设备被用于运行AI工作负载。基于M系列Ultra芯片的计算设备受欢迎程度,无疑推动了苹果研发采用相同芯片的企业服务器。该产品预计于2029年发布,这将是苹果近二十年来首次推出服务器产品。(Ars Technica AI)研究表明多数浏览器钱包存在隐私泄露风险,可被追踪用户Techub News 消息,比利时鲁汶大学研究人员测试了 85 款主流浏览器扩展钱包,发现其中 36 款(约占研究样本安装量的 82%)存在隐私泄露风险。这些钱包在用户签署交易前,就可能因向外部服务器发送地址以查询余额而被指纹识别和追踪。
研究还发现,在 36 款受影响钱包中,有 17 款可能暴露同一用户不同地址间的关联;22 款即使用户撤销访问权限并重启浏览器后,网站仍可能读取地址。此外,23 款钱包存在地址通过其他网站加载的内容泄露的风险。
被联系的大多数钱包提供商未将此视为严重漏洞。Coinbase Wallet、Coin98 和 Hana 已进行更改,而 MetaMask、Rabby 和 OKX 等则未作改动。研究同时测试了 30 款去中心化应用,发现仅 11 款在用户点击“断开连接”或注销时能正确撤销钱包访问权限。 (BeInCrypto)0 篇文章