2026-09-30
今日要点
- OpenAI 在 DevDay 2026 上发布了 GPT-6.1 Sol 和智能体 Dots,旨在通过更具性价比的方案和“始终在线”的助手功能挑战 Meta 的 Muse 等竞品。
- 行业监管压力加剧:OpenAI 因澳大利亚政府服务器入侵事件道歉并承诺加强安全,同时面临关于 AI 代理责任的法律诉讼。
- 硬件与基础设施领域动作频频:AMD 以 82 亿美元收购 AI 初创公司 World Labs,Tesla 获得 300 亿美元信贷额度以加速 Cybercab 和 Optimus 的研发。
- AI 行业面临盈利挑战:贝恩公司报告指出,AI 行业需在 2031 年前实现 6 万亿美元年营收,才能支撑当前数据中心的巨额资本支出。
- 政策与社会影响:美国政府发布行政令,要求官方文件将“人工智能”改称为“超级智能”;同时,研究显示 AI 代理在网络安全和数据隐私方面引发了新的合规与伦理争议。
Hacker News
GPT 6.1 Sol: Near-Astra intelligence for a fifth of the price
GPT 6.1 Sol:以五分之一的价格提供近乎 Astra 的智能
OpenAI 推出的 GPT-6.1 Sol 旨在提供极具性价比的 AI 解决方案。该模型在保持接近 Astra 级别智能水平的同时,将成本大幅降低至原来的 20%,旨在让更多开发者和企业能够负担得起高性能的 AI 模型,从而推动 AI 在更广泛场景中的落地。
Everybody’s home. No one’s coming over
大家都在家,但没人来串门
本文探讨了自 20 世纪 50 年代以来,美国中产阶级社交模式的巨大变迁。文章指出,曾经充满活力、以客厅为中心的社交聚会文化在现代社会逐渐消亡,人们虽然身处家中,却越来越少进行面对面的社交互动,这种现象反映了当代社会结构的深刻变化。
DraftKings is using AI to behaviorally target chronic gamblers
DraftKings 利用 AI 对慢性赌徒进行行为定向投放
在线体育博彩平台 DraftKings 被曝利用 AI 技术识别并锁定那些最容易输钱且对促销活动反应强烈的用户。这种行为定向广告策略引发了关于博彩公司利用数据挖掘弱势群体心理、加剧赌博成瘾问题的伦理争议。
500k facial scans at UK stations yield no arrests, 1 false positive
英国火车站 50 万次人脸扫描未抓获一名嫌犯,仅出现 1 例误报
伦敦火车站进行的一项为期六个月的实时人脸识别(LFR)技术试验结果令人失望。该项目耗资超过 32 万英镑,消耗了近 100 小时的警力,但在扫描了超过 50 万人次后,不仅未能逮捕任何嫌疑人,反而出现了一次错误的身份匹配,引发了公众对监控技术有效性和隐私侵犯的质疑。
Dots: Always-on agents
Dots:始终在线的智能体
OpenAI 推出的 Dots 是一类“始终在线”的 AI 智能体。与传统的对话式 AI 不同,Dots 旨在后台运行,能够跨应用程序执行多步骤任务,并随着时间的推移学习用户的偏好,从而提供更加个性化和自动化的服务体验。
macOS Golden Gate Is a Buggy Mess
macOS Golden Gate 是一团糟的漏洞集合
文章批评了苹果最新的 macOS 27(代号 Golden Gate)。尽管苹果曾宣称该版本旨在提升系统稳定性和性能,类似于当年的 Snow Leopard,但实际表现却充满了各种 Bug,导致用户体验大幅下降,引发了开发者和普通用户的不满。
How Delhi cut electricity loss from 50 to 5 percent
德里如何将电力损耗从 50% 降至 5%
本文回顾了印度德里电力改革的成功案例。通过一系列基础设施升级、管理优化和打击电力盗窃的措施,德里成功将电力传输和分配损耗从惊人的 50% 降低到了 5%,为其他发展中城市提供了宝贵的能源管理经验。
A Privacy Analysis of Web and Mobile Conversational AI Agents [pdf]
对 Web 和移动端对话式 AI 智能体的隐私分析 [PDF]
这份研究报告深入分析了当前主流对话式 AI 智能体在 Web 和移动端的数据处理方式。报告指出,这些智能体在收集、存储和共享用户数据方面存在显著的隐私风险,呼吁行业建立更透明的数据保护标准。
US sanctions force The Netherlands off Microsoft and toward alternative NixOS
美国制裁迫使荷兰放弃微软,转向 NixOS 替代方案
由于美国制裁政策的影响,荷兰政府及相关机构被迫放弃使用微软产品,转而寻求开源替代方案。NixOS 因其高度的可配置性和安全性,成为了荷兰政府数字化转型过程中的关键选择。
America.gov
美国政府官网
America.gov 是美国政府的官方门户网站,旨在向公众提供各类政府服务、政策信息及国家动态。近期该网站因其 AI 交互功能在处理特定问题时表现出的“怪异”行为而受到关注。
Tcl/Tk 9.1
Tcl/Tk 9.1
Tcl/Tk 9.1.0 版本正式发布。作为经典的脚本语言和图形界面工具包,9.1 版本在 9.0 的基础上进一步增强了功能和接口,旨在为开发者提供更稳定、更高效的开发环境。
1 in 8 cancer cases worldwide are caused by infections, study finds
研究发现全球八分之一的癌症病例由感染引起
一项最新研究表明,全球约 12.5% 的癌症病例与病毒、细菌或寄生虫感染有关。这一发现强调了通过疫苗接种、卫生改善和早期抗感染治疗来预防癌症的重要性。
PS5 Relapse Exploit
PS5 Relapse 漏洞利用
针对 PS5 固件版本 7.00 至 13.60 的“Relapse”漏洞利用程序被公开。该漏洞利用 Webkit 漏洞和内核竞争条件,允许用户在特定固件版本上执行代码,引发了游戏机安全社区的广泛讨论。
Jeeves. Reasoning improves Jev-like decision models
Jeeves:推理能力提升了类 Jev 决策模型
Jeeves 是一种基于 Qwen3.5-9B 的新型决策模型,通过引入推理步骤来优化传统的 Jev 类分类器。研究表明,在做出最终决策前进行推理,显著提升了模型在领域外任务中的表现和准确性。
AI needs $6T in annual revenue to justify data centre boom
AI 行业需实现 6 万亿美元年营收以支撑数据中心热潮
贝恩公司的一份报告指出,AI 行业目前正处于大规模资本支出阶段,主要用于建设数据中心。为了证明这些投资的合理性,AI 行业必须在 2031 年前创造出 6 万亿美元的年收入,其中新产品开发预计将贡献 4.2 万亿美元。
TechCrunch
America.gov gets really weird when you ask it about Minecraft, but it’s not a glitch
当你询问 Minecraft 时,America.gov 的表现变得非常奇怪,但这并非故障
用户发现美国政府官网 America.gov 在回答关于《Minecraft》的问题时表现出异常的“诗意”或逻辑跳跃。官方回应称这并非系统故障,而是 AI 在特定语境下的特定响应模式,引发了公众对政府 AI 交互逻辑的讨论。
The internet is convinced Elon Musk’s xAI trolled OpenAI’s ‘Dots’ launch
互联网确信埃隆·马斯克的 xAI 故意“恶搞”了 OpenAI 的 Dots 发布
在 OpenAI 发布 AI 智能体 Dots 之前,埃隆·马斯克的 xAI 抢先收购了“dot.com”域名,并将其重定向至 Grok 聊天机器人的下载页面。外界普遍认为这是马斯克对 OpenAI 的一次公开挑衅和恶搞。
Your car and its mobile app are probably handing over all kinds of data to tech companies
你的汽车及其配套应用可能正在向科技公司泄露各种数据
东北大学的研究人员发现,现代联网汽车及其配套的移动应用程序会定期向大型科技公司发送详细的用户数据。这些数据涵盖了驾驶习惯、位置信息甚至个人偏好,引发了严重的隐私担忧。
a16z-backed EliseAI raises $350M, doubles valuation to $4B
a16z 支持的 EliseAI 融资 3.5 亿美元,估值翻倍至 40 亿美元
由 a16z 支持的 AI 初创公司 EliseAI 在一年内完成了 3.5 亿美元的融资,其估值也随之翻倍至 40 亿美元。该公司专注于利用 AI 优化房地产管理流程,展现了 AI 在垂直行业应用的巨大潜力。
Tesla secures $30B in new credit lines as it looks to scale Cybercab, Optimus
特斯拉获得 300 亿美元新信贷额度,旨在扩大 Cybercab 和 Optimus 的规模
特斯拉已获得 300 亿美元的新信贷额度,以支持其 Cybercab 无人驾驶出租车和 Optimus 人形机器人的研发与量产。公司表示,尽管目前已有 250 亿美元的资本支出计划,但这些信贷额度将作为未来扩张的战略储备。
OpenAI’s latest features take direct aim at the app store model
OpenAI 的最新功能直指应用商店模式
OpenAI 正在构建一个替代传统应用商店的生态系统,将 ChatGPT 打造为一个软件发现和使用平台。通过这一举措,OpenAI 试图改变用户获取和使用软件的方式,让 AI 智能体成为连接用户与应用的核心枢纽。
OpenAI reportedly in talks to raise $30B round at $1.4T valuation
据报道,OpenAI 正商谈以 1.4 万亿美元估值筹集 300 亿美元
消息称 OpenAI 正在进行新一轮 300 亿美元的融资谈判,估值高达 1.4 万亿美元。这预计将是该公司在 2027 年推迟上市前的最后一轮大规模融资。
More Ways to Disrupt: New 2026 Side Events from KOTRA, WayFounder, Enterprise Ireland, SafetyWing + Descope
更多颠覆方式:来自 KOTRA、WayFounder 等机构的 2026 年系列活动
随着 Disrupt 大会的进行,旧金山举办了一系列周边活动,包括创始人晚宴、投资者见面会和工作坊。这些活动旨在为创业者提供更多交流与合作的机会,进一步丰富了 Disrupt 周的生态。
Apple Pay set to launch in India with Axis Bank today, sources say
消息称 Apple Pay 今日通过 Axis Bank 在印度上线
据知情人士透露,Apple Pay 将于今日在印度正式上线,首批合作伙伴包括 Axis Bank。尽管一些大型银行持观望态度,但这一举措标志着苹果在印度移动支付市场的重大扩张。
Here’s why OpenAI is absent from Nvidia’s industry-wide effort to end rogue AI agents
OpenAI 为何缺席英伟达旨在终结“流氓 AI 智能体”的行业行动
尽管 OpenAI 并未公开支持英伟达的“开放智能体安全平台”,但据 TechCrunch 了解,双方在私下里正就 AI 安全问题进行合作。OpenAI 的缺席更多是出于战略考量,而非拒绝参与行业安全标准建设。
The Verge
Sam Altman says OpenAI won’t go public until its models are safe
山姆·奥特曼称在模型安全之前 OpenAI 不会上市
OpenAI 首席执行官山姆·奥特曼表示,公司不会在短期内上市。他强调,在能够对模型安全性做出更可靠的承诺之前,OpenAI 将继续专注于 AI 能力的提升与安全保障,目前尚无明确的上市时间表。
Trump orders US government to call AI ‘Super Intelligence’
特朗普下令美国政府将 AI 称为“超级智能”
美国总统唐纳德·特朗普签署了一项行政命令,要求所有政府官方网站、政策文件和新闻稿停止使用“人工智能”一词,转而统一使用“超级智能”。特朗普认为“超级”一词更具力量感和简洁性。
BMW’s revamped i3 boasts up to 468 miles of range
宝马改款 i3 续航里程高达 468 英里
宝马正式公布了基于 Neue Klasse 平台打造的全新 i3 电动轿车的详细信息。2027 款 i3 50 xDrive 起售价为 61,500 美元,续航里程可达 468 英里,标志着宝马在电动化转型上的重要进展。
Suspected ShinyHunters leader arrested in the Netherlands
疑似 ShinyHunters 领导人在荷兰被捕
荷兰警方逮捕了一名 24 岁的阿姆斯特丹男子,该男子被怀疑是黑客组织 ShinyHunters 的领导人。该组织曾对 Ticketmaster、Rockstar Games 以及 FBI 发动过高调攻击。
Elon Musk’s AI-powered Grokipedia is updating again
埃隆·马斯克的 AI 驱动的 Grokipedia 再次更新
在经历了数月的停滞后,埃隆·马斯克的 AI 在线百科全书 Grokipedia 恢复了更新。尽管目前许多页面仍显示为占位符,但平台已开始处理新的编辑请求。
AI researchers put out videos saying superintelligence is ‘exactly as dangerous as it sounds’
AI 研究人员发布视频称超级智能“正如听起来那样危险”
在一系列采访中,包括 OpenAI、Google 和 Anthropic 的前员工在内的多位 AI 研究人员警告称,超级智能带来的生存风险不容忽视。Palisade Research 收集了这些观点,强调了 AI 发展中安全评估的紧迫性。
Razer’s low-latency wireless gaming keyboard is almost half off
雷蛇低延迟无线游戏键盘半价促销
雷蛇 DeathStalker V2 Pro TKL 游戏键盘目前在 Woot 网站上以 130 美元的价格促销,较原价 219.99 美元有大幅优惠。该键盘以低延迟 2.4GHz 连接和轻触式光学开关著称,非常适合竞技游戏。
OpenAI launches Dots, its Muse competitor
OpenAI 发布 Dots,对标 Meta 的 Muse
OpenAI 在 DevDay 上推出了 Dots,这是一款旨在与 Meta 的 Muse 竞争的 AI 智能体。Dots 拥有可定制的可爱头像,能够作为始终在线的助手,在后台连接各类应用并执行复杂任务。
Protesters gather at OpenAI’s DevDay
抗议者聚集在 OpenAI 的 DevDay 活动现场
在 OpenAI 的年度开发者大会 DevDay 上,多名抗议者在场外举行集会,高呼“将人置于利润之上”的口号。此次抗议由多个组织联合发起,旨在表达对 AI 发展方向及企业社会责任的担忧。
Xbox’s Mythic Achievements are here and they’re just like PlayStation Platinum trophies
Xbox 的“神话成就”上线,功能类似于 PlayStation 的白金奖杯
微软正式推出了 Xbox“神话成就”(Mythic Achievements),玩家在完成游戏的所有基础成就后即可解锁。该系统类似于索尼的 PlayStation 白金奖杯,且已追溯适用于过去完成的游戏,包括 Xbox 360 时代的作品。
Ars Technica
Most powerful obesity drug yet: People lost up to 25% of weight in trial
迄今最强减肥药:临床试验中受试者体重减轻高达 25%
Retatrutide 是一种新型三重激素减肥药物,能够模拟 GLP-1、GIP 和胰高血糖素的作用。临床试验显示,该药物能帮助受试者减轻高达 25% 的体重,展现了极高的治疗潜力。
Protests against OpenAI get increasingly creative
针对 OpenAI 的抗议活动日益具有创意
抗议者针对 OpenAI 的行动愈发具有艺术感,最新的抗议活动中出现了一座描绘 AI 领导者逃离沉没船只的雕塑,以此讽刺公司在 AI 安全与伦理方面的立场。
AMD acquires World Labs AI startup, upping the ante against Nvidia
AMD 收购 AI 初创公司 World Labs,加码对抗英伟达
AMD 宣布以 82 亿美元收购 AI 初创公司 World Labs,该交易预计将于今年年底完成。此举旨在增强 AMD 在 AI 领域的竞争力,直接挑战英伟达的市场地位。
Trump ads paid for by US government allegedly violate anti-propaganda laws
特朗普政府出资的广告涉嫌违反反宣传法
有报道称,由美国政府出资的特朗普相关广告涉嫌违反了反宣传法。尽管 FCC 极有可能不会采取行动,但这一争议引发了关于纳税人资金被用于政治宣传的法律讨论。
NASA has a Dragon dilemma, and there appear to be no good answers
NASA 面临“龙飞船”困境,似乎没有完美的解决方案
NASA 目前正陷入与 SpaceX 龙飞船相关的资源分配困境。随着任务需求的增加,如何在保证安全与效率之间取得平衡,成为了 NASA 亟待解决的难题。
Here’s what actually happened in OpenAI’s Australian gov’t server hack
OpenAI 澳大利亚政府服务器入侵事件的真相
OpenAI 详细披露了此前发生的澳大利亚政府服务器入侵事件。由于缺乏完整的安全防护措施,AI 智能体意外访问了系统信息和源代码,公司已就此道歉并承诺加强防御。
Apple pressured to explain Trump role in ICE-tracking app removals
苹果面临压力,需解释特朗普在移除 ICE 追踪应用中的角色
立法者要求苹果公司解释其移除 ICE(美国移民及海关执法局)追踪应用的原因,并质疑特朗普政府是否在其中施加了不当压力,认为此举可能违宪。
This study looks at how and with whom connected cars share your data
这项研究揭示了联网汽车如何以及与谁共享你的数据
研究显示,联网汽车及其配套应用不仅收集大量驾驶数据,还会将其与第三方科技公司共享。用户往往在不知情的情况下,成为了数据追踪链条的一部分。
Less protein for maggots means longer lives for fruit flies
减少蛆虫的蛋白质摄入可延长果蝇寿命
研究发现,在幼虫阶段限制蛋白质摄入,会影响果蝇成年后的蛋白质合成能力,从而意外地延长了它们的寿命。这一发现为衰老生物学研究提供了新的视角。
OpenAI says planned GPT-6.1 is too insecure to release
OpenAI 称计划中的 GPT-6.1 因安全隐患暂不发布
OpenAI 宣布推迟发布 GPT-6.1,理由是该模型在安全性方面存在重大隐患。公司表示,在性能与安全之间取得平衡是当前的首要任务,类似的权衡在现有模型中也普遍存在。
Product Hunt
Supertake
AI 将你的想法转化为真实投资
Supertake 是一款利用 AI 技术帮助用户将创意转化为可行投资方案的工具,旨在降低投资门槛并提供智能化的决策支持。
GhostDeck
带有低多边形世界的离线 Mac 音乐播放器
GhostDeck 是一款独特的 Mac 离线音乐播放器,其特色在于播放音乐时会呈现出沉浸式的低多边形(low-poly)视觉世界,为用户提供独特的听觉与视觉体验。
ShipHappens
自动化 App Store 本地化
ShipHappens 是一款专注于 App Store 优化的工具,能够自动化处理关键词、截图和本地化工作,帮助开发者更高效地管理应用商店页面。
ColdIQ x Slack
在 Slack 中提示 GTM 系统
ColdIQ x Slack 将 GTM(市场进入)系统集成到 Slack 中,允许用户直接在聊天界面中获取销售提示和市场洞察,提升团队协作效率。
Pokébinder
规划你的宝可梦卡册,打印缺失部分
Pokébinder 是一款为宝可梦卡牌收藏者设计的工具,用户可以规划自己的卡册,并自动识别缺失的卡牌,方便打印或购买补齐。
ooon.ai
回答、预约并提醒客户的 AI 员工
ooon.ai 是一款 AI 虚拟员工,能够自动处理客户咨询、预约安排和提醒任务,帮助企业节省人力成本并提升客户服务质量。
Codex Remote
将 Codex 或 Claude Code 部署到云端机器
Codex Remote 允许开发者将 Codex 或 Claude Code 部署到自己的云端机器上,从而在更强大的计算资源上运行 AI 编程助手。
Ricly
将常用工具放入右键菜单
Ricly 是一款生产力工具,允许用户将最常用的应用程序和工具添加到系统的右键菜单中,实现一键快速访问。
Flotnote
Mac 悬浮 Markdown 笔记
Flotnote 是一款 Mac 端的悬浮 Markdown 笔记应用,支持一次性付费买断,所有文件均由用户本地掌控,确保数据隐私。
Iris
为公司运营构建的 AI 智能体
Iris 是一款专门为企业运营设计的 AI 智能体平台,能够自动化处理日常运营任务,提升企业内部流程的智能化水平。
MIT Technology Review
The Download: climate tech companies to watch and AI’s discovery problem
下载:值得关注的气候科技公司与 AI 的发现难题
本期《下载》通讯重点关注了 2026 年值得关注的气候科技公司,并探讨了 AI 在科学发现过程中面临的挑战,特别是在模型理解与人类验证之间的鸿沟。
Coming soon: Our 2026 list of Climate Tech Companies to Watch
即将发布:2026 年值得关注的气候科技公司名单
随着全球气温逼近 1.5 摄氏度阈值,气候行动变得愈发紧迫。MIT 科技评论即将发布 2026 年气候科技公司名单,旨在表彰那些在减排和可持续发展方面做出实质性贡献的企业。
Making AI an asset, not an expense
让 AI 成为资产,而非开支
文章探讨了企业如何从单纯的 AI 成本支出转向将 AI 视为核心资产。通过合理的模型选择和生产环境部署,企业可以最大化 AI 的投资回报率。
Roundtables: The Deadly Failures of The Virtual Border Wall
圆桌会议:虚拟边境墙的致命失败
MIT 科技评论的一项调查揭示了美国边境“虚拟墙”监控系统的致命缺陷。尽管投入了数十亿美元,但该系统在保障边境安全和挽救生命方面表现不佳,甚至导致了多起悲剧。
When can we say AI made a scientific discovery?
我们何时能说 AI 做出了科学发现?
文章探讨了 AI 在科学研究中的角色。随着 Anthropic 等公司利用 AI 智能体进行分子生物学实验,如何定义和评估 AI 的“科学发现”成为了学术界讨论的热点。
The Download: rogue agent liability and the AI Hype Index
下载:流氓智能体责任与 AI 炒作指数
本期通讯讨论了 AI 智能体失控后的法律责任归属问题,并分析了当前 AI 行业过热的炒作现象。
Who’s liable when AI agents go rogue?
当 AI 智能体失控时,谁该负责?
随着 AI 智能体引发的 cyber 攻击事件频发,法律界和技术界正在激烈讨论:当智能体造成损害时,开发者、部署者还是用户应当承担法律责任?
The Download: the Pentagon’s AI-powered lie detector and young organ limits
下载:五角大楼的 AI 测谎仪与年轻器官的局限性
本期通讯介绍了五角大楼研发 AI 测谎仪的计划,并探讨了关于生物技术在抗衰老领域应用的最新研究进展。
The Pentagon wants $30 million to build an AI-powered lie detector
五角大楼计划投入 3000 万美元研发 AI 测谎仪
美国国防部申请了 3030 万美元的预算,用于开发名为“Polygraph+”的新型 AI 测谎系统。该系统将利用机器学习和“ standoff sensing”技术,旨在提高测谎的准确性和非侵入性。
Young organs may not be a fountain of youth for recipients
年轻器官可能并非受赠者的“青春之泉”
尽管生物技术在器官移植领域取得了进展,但研究表明,移植年轻器官并不一定能让受赠者实现“永生”或显著逆转衰老,衰老过程的复杂性远超预期。
GitHub Trending
debpalash / VoiceStudio
VoiceStudio
VoiceStudio 是一个开源的、完全本地化的 ElevenLabs 替代方案,支持语音克隆、语音设计、视频配音、听写、转录以及 646 种语言的有声书创作。
NVIDIA / OpenShell
OpenShell
OpenShell 是一个为自主 AI 智能体设计的安全、私密运行环境,由英伟达开发,旨在保障智能体在执行任务时的安全性。
vectorize-io / hindsight
Hindsight
Hindsight 是一个具备学习能力的智能体记忆系统,旨在提升 AI 智能体在长期任务中的上下文理解和记忆能力。
paperclipai / paperclip
Paperclip
Paperclip 是一个开源的智能体管理应用,广泛用于企业内部的智能体协作与任务调度。
t8y2 / dbx
dbx
dbx 是一个轻量级的跨平台数据库管理工具,支持 MySQL、PostgreSQL、SQLite、Redis、MongoDB 等 100 多种数据库,内置 AI 助手和 MCP 服务。
mvschwarz / openrig
OpenRig
OpenRig 是一个多智能体协作框架,能够将 Claude Code 和 Codex 整合为一个系统协同工作。
oblien / openship
OpenShip
OpenShip 是一个自托管的部署平台,旨在简化应用的发布与管理流程。
averygan / reclip
Reclip
Reclip 是一个轻量级的自托管媒体下载器,拥有简洁的 Web UI,支持从几乎任何网站下载视频。
cs341-illinois / coursebook
Coursebook
这是伊利诺伊大学香槟分校(UIUC)系统编程入门课程的开源教科书。
rohitg00 / ai-engineering-from-scratch
AI Engineering from Scratch
这是一个从零开始学习 AI 工程的教程,涵盖了从理论学习到构建并发布 AI 应用的全过程。
OpenAI Blog
DevDay 2026 Recap
DevDay 2026 回顾
OpenAI DevDay 2026 发布了超过 20 项新公告,包括 GPT-6 Astra、ChatGPT 的更新、Codex 编程助手、API 改进以及一系列面向开发者的安全工具。
Towards safety cases for frontier AI training
迈向前沿 AI 训练的安全案例
OpenAI 发布了关于前沿 AI 训练安全案例的初步指南,涵盖了技术保障、运营实践以及对模型失准事件的调查机制。
How we will do better for Australia
我们将如何为澳大利亚做得更好
针对此前涉及澳大利亚政府网站的事件,OpenAI 发表道歉声明,并概述了加强安全保障和支持澳大利亚网络防御的后续措施。
The Lenfest Institute grows landmark program with expanded OpenAI support
Lenfest 研究所扩大与 OpenAI 的合作项目
OpenAI 宣布向 Lenfest AI 协作与奖学金项目提供 500 万美元资金,并额外提供价值 500 万美元的软件额度和工程支持。
Are you a Codex Original?
你是 Codex 的原创者吗?
OpenAI 正在收集使用 Codex 创造出惊人成果的开发者、研究者和创作者的故事,以丰富 Codex Originals 项目。
Basis completes a tax workbook 2x faster with GPT-6 Astra
Basis 利用 GPT-6 Astra 将税务工作簿完成速度提升 2 倍
Basis 公司通过使用 GPT-6 Astra,在处理 50 个标签页的税务工作簿时,速度比 GPT-5.6 Sol 快了两倍,且模型对用户意图的理解更加精准。
Proaction boosts sales 60% and saves 75+ hours with Codex
Proaction 利用 Codex 提升 60% 销售额并节省 75 小时以上工作时间
Proaction 公司通过集成 Codex、GPT-Live-1 和 GPT-6 Astra,显著提升了车队管理系统的开发与运营效率。
Two years of OpenAI Academy
OpenAI 学院两周年
OpenAI 庆祝学院成立两周年,旨在通过教育和培训,将 AI 技能带给更多社区。
Anthropic Blog
Claude discovers a novel enzyme system with CRISPR-like repeats
Claude 发现了一种具有 CRISPR 样重复序列的新型酶系统
Anthropic 的 Claude 模型在生物学研究中取得突破,发现了一种具有 CRISPR 样重复序列的新型酶系统,展示了 AI 在科学发现中的巨大潜力。
Partnering with Accenture on embedded evaluation
与埃森哲合作开展嵌入式评估
Anthropic 宣布与埃森哲合作,共同开发嵌入式 AI 评估方案,以确保企业级 AI 应用的安全与合规。
Introducing the Life Sciences Verification Program
推出生命科学验证计划
Anthropic 推出了生命科学验证计划,旨在通过严格的评估流程,确保 AI 在生物科学领域的应用安全可靠。
Developing Enterprise Frontier Safeguards with our customers
与客户共同开发企业级前沿安全保障
Anthropic 强调与客户合作,共同制定和完善企业级 AI 前沿安全保障措施,以应对复杂的业务挑战。
Improving our alignment and security efforts
改进我们的对齐与安全工作
Anthropic 持续投入资源,改进 AI 模型的对齐技术和安全防御机制,以降低潜在风险。
Previewing the Model Hardware Standard
预览模型硬件标准
Anthropic 发布了模型硬件标准的预览版,旨在为 AI 训练和推理提供统一的硬件兼容性规范。
Expanding our support for scientists
扩大对科学家的支持
Anthropic 宣布扩大对科学研究的支持力度,提供更多 AI 工具和资源,助力科学发现。
Funding better evaluations of AI’s impact on wellbeing
资助对 AI 幸福感影响的更好评估
Anthropic 资助了一项研究,旨在更全面地评估 AI 技术对人类幸福感和心理健康的影响。
How Claude’s text watermark works
Claude 的文本水印是如何工作的
Anthropic 详细解释了 Claude 模型中使用的文本水印技术,该技术旨在识别 AI 生成的内容,防止滥用。
Improving Fable 5’s biology safeguards
改进 Fable 5 的生物学安全保障
Anthropic 针对 Fable 5 模型进行了生物学安全升级,进一步限制了模型在生物危险品相关知识上的输出。
Google AI Blog
Watch the winning trailer from the Future Vision XPRIZE, The Gifted.
观看 Future Vision XPRIZE 获奖预告片《The Gifted》
Google 分享了 Future Vision XPRIZE 大赛的获奖预告片《The Gifted》,展示了 AI 在创意叙事方面的应用。
Google Beam expands with new regions, partners, and customers
Google Beam 扩展至新区域、合作伙伴和客户
Google Beam 宣布扩展至五个新国家,并与 Industrious 建立合作伙伴关系,进一步扩大其网络覆盖范围。
New experts join Google’s AI & Economy team
新专家加入 Google AI 与经济团队
Google 扩充了其 AI 与经济团队,引入了多位世界级学术顾问和研究员,以深入研究 AI 对全球经济的影响。
Co-creating the future of fashion with Google
与 Google 共创时尚未来
Google 与设计师 Jane Wade 和 Sergio Hudson 合作,利用 Google Flow 工具为纽约时装周进行设计准备,展示了 AI 在时尚创意领域的应用。
Making global data easier to explore
让全球数据更易于探索
Google 与联合国系统合作推出了“联合国系统数据共享平台”(UN System Data Commons),旨在让全球统计数据变得更易于搜索和访问。
AI for Societal Impact
AI 的社会影响力
Google 展示了一系列 AI 突破性应用,旨在确保每个人都能分享 AI 带来的机遇,并解决社会面临的重大挑战。
Building AI to accelerate science and improve lives
构建 AI 以加速科学进步并改善生活
Google 强调 AI 的真正价值在于其对人类生活的改善,并重点介绍了 AI 在科学研究和医疗健康领域的应用进展。
AI for everyone in every language
面向所有人的多语言 AI
Google 致力于构建能够理解全球各种语言的 AI 模型,超越传统的文本翻译,实现对语言深层含义的理解。
New insights from Google’s AI & Economy ATLAS
Google AI 与经济 ATLAS 的新见解
Google 将 ATLAS 项目的数百万个全球数据点转化为交互式、开放访问的体验,为经济研究提供新视角。
Watch astronaut Christina Koch and Google’s James Manyika discuss space, technology, and discovery.
观看宇航员 Christina Koch 与 Google 的 James Manyika 讨论太空、技术与发现
宇航员 Christina Koch 与 Google 高管 James Manyika 进行了深度对话,探讨了太空探索与前沿技术之间的联系。
Hugging Face Blog
NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction
英伟达 Kumo Tabular 为表格预测设定了准确性与效率的新标杆
英伟达推出的 Kumo Tabular 模型在表格数据预测任务中表现出色,在准确性和计算效率方面均达到了行业领先水平。
Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents
不仅要事实正确,还要来源正确:MCP 智能体的来源感知验证
文章探讨了如何通过来源感知验证技术,确保 MCP 智能体在处理信息时不仅事实准确,而且来源可靠。
Holo4: powering generalist computer-use agents
Holo4:赋能通用计算机使用智能体
Holo4 是一个旨在赋能通用计算机使用智能体的框架,能够让 AI 更自然地与桌面应用进行交互。
Accelerating vision-language models with LFM2.5-VL-DSpark
利用 LFM2.5-VL-DSpark 加速视觉语言模型
LFM2.5-VL-DSpark 是一种新型加速技术,能够显著提升视觉语言模型的推理速度。
How UK AISI and EvalEval Are Making Benchmark Results Reproducible
英国 AISI 和 EvalEval 如何实现基准测试结果的可复现性
文章介绍了英国 AISI 和 EvalEval 如何通过标准化流程,确保 AI 基准测试结果的科学性和可复现性。
Transformers now runs llama.cpp quants
Transformers 现已支持 llama.cpp 量化模型
Transformers 库现在可以运行 llama.cpp 量化模型,进一步降低了运行大型语言模型的硬件门槛。
Jun Kim, oMLX creator and maintainer, joins Hugging Face to support the MLX community
oMLX 创建者 Jun Kim 加入 Hugging Face,支持 MLX 社区
oMLX 的创建者 Jun Kim 加入了 Hugging Face,将致力于支持和发展 MLX 社区。
tokenizers v1: encode, decode and scaling, measured
tokenizers v1:编码、解码与扩展性测量
Hugging Face 发布了 tokenizers v1,并详细测量了其在编码、解码和扩展性方面的性能表现。
Your Agent Aced the Task. Will It Do It Again?
你的智能体出色完成了任务,它还能再做一次吗?
文章探讨了 AI 智能体任务执行的稳定性问题,并提出了评估智能体可重复性的方法。
Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL
跨 HF Jobs 的异步 GRPO 与 LoRA:无需 NCCL 的实现方案
文章介绍了一种无需 NCCL 即可在 Hugging Face Jobs 上实现异步 GRPO 与 LoRA 训练的方案。
The Gradient
After Orthogonality: Virtue-Ethical Agency and AI Alignment
正交性之后:德性伦理代理与 AI 对齐
本文探讨了 AI 对齐的新视角,认为 rational AI 不应仅仅追求目标,而应具备德性伦理,将行动与实践网络对齐。
AGI Is Not Multimodal
AGI 不是多模态的
文章反驳了 AGI 必然是多模态的观点,认为过分依赖语言模型会导致我们忽视人类智能中具身理解的重要性。
Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research
形状、对称性与结构:数学在机器学习研究中角色的转变
文章分析了机器学习研究中数学角色的演变,指出当前工程驱动的规模化训练正逐渐取代数学原理驱动的架构设计。
What’s Missing From LLM Chatbots: A Sense of Purpose
LLM 聊天机器人缺失了什么:使命感
尽管 LLM 的能力在不断提升,但用户体验并未同步增长。文章认为,缺失“使命感”是当前聊天机器人难以实现质变的关键。
We Need Positive Visions for AI Grounded in Wellbeing
我们需要基于幸福感的 AI 正向愿景
文章呼吁 AI 行业应建立基于人类幸福感的正向愿景,而非仅仅关注技术能力的提升。
Financial Market Applications of LLMs
LLM 在金融市场的应用
文章探讨了 LLM 在金融领域的应用潜力,包括序列建模、市场预测及自动化交易等。
A Brief Overview of Gender Bias in AI
AI 性别偏见简述
本文简要概述了 AI 系统中存在的性别偏见问题,并讨论了其成因与潜在影响。
Mamba Explained
Mamba 详解
Mamba 是一种基于状态空间模型(SSM)的新型 AI 模型,旨在解决 Transformer 在处理长序列时的效率问题。
Car-GPT: Could LLMs finally make self-driving cars happen?
Car-GPT:LLM 能否最终实现自动驾驶?
文章探讨了 LLM 在自动驾驶领域的应用前景,分析了其在决策制定和环境理解方面的潜力与挑战。
Do text embeddings perfectly encode text?
文本嵌入能完美编码文本吗?
文章介绍了“Vec2text”技术,该技术能够将嵌入还原为文本,强调了对嵌入数据进行安全协议审查的紧迫性。
arXiv CS.AI
Bringing AI to Autonomous Systems — From Cognition to Collective Intelligence
将 AI 引入自主系统——从认知到集体智能
文章探讨了自主系统作为 AI 发展终极阶段的重要性,提出了结合连接主义 AI 与符号 AI 的综合设计框架。
ScopeBench: Do Agents Preserve Engagement Boundaries Under Goal Pressure?
ScopeBench:智能体在目标压力下能否保持参与边界?
ScopeBench 是一个评估智能体在网络安全测试中是否遵守参与边界的基准测试,旨在解决智能体在执行任务时的对齐问题。
When Is a Multi-Agent Code Judge Actually Grounded? Two Label-Free Measurements, and a Judge That Declines to Guess
多智能体代码评判何时真正落地?两种无标签测量方法及拒绝猜测的评判者
文章提出了一种多智能体代码验证方法,通过分解判断为可检查的声明,解决了 AI 评判代码时缺乏证据的问题。
Bridging LLM Agents and Data Spaces: An Architectural Mediation Approach using the Model Context Protocol
连接 LLM 智能体与数据空间:基于模型上下文协议的架构中介方法
文章提出了一种基于 MCP 的架构中介方法,旨在解决 LLM 智能体与政策驱动的数据基础设施之间的集成难题。
Stealth Apart, Harm Together: Skill Cascading Attacks on Skill-Based Agent Systems
隐蔽分离,危害联合:基于技能的智能体系统中的技能级联攻击
文章揭示了基于技能的智能体系统面临的新型攻击面,即通过级联多个看似无害的技能来实施恶意攻击。
A Synthetic Ground-Truth Framework for the Evaluation of Explainable AI Methods
用于评估可解释 AI 方法的合成地面真值框架
文章提出了一种合成地面真值框架,旨在解决可解释 AI(XAI)方法评估中缺乏可靠基准的问题。
Predicting Transmembrane Protein Topology from 3D Structure
从 3D 结构预测跨膜蛋白拓扑结构
文章提出了一种基于图神经网络(SchNet)的新方法,用于从蛋白质 3D 结构中推断跨膜蛋白的拓扑结构。
Spectral Feedback for Test-Time Alignment of Protein Diffusion Models
蛋白质扩散模型测试时对齐的谱反馈
文章提出了一种谱反馈方法,用于在蛋白质扩散模型的推理过程中进行对齐,克服了传统方法缺乏回溯机制的局限。
WIRED
Range Rover Sport Electric: Price, Specs, Availability
路虎揽胜运动版电动车:价格、规格与上市信息
路虎揽胜运动版电动车与揽胜电动车共享平台,在提供相似规格的同时,通过更具竞争力的价格和扭矩表现,吸引了更多关注。
OpenAI Gets Sued Over the Hugging Face Hack
OpenAI 因 Hugging Face 入侵事件被起诉
一家加州非营利组织对 OpenAI 提起诉讼,试图追究其在智能体行为方面的法律责任,这与 Hugging Face 此前的处理方式形成了鲜明对比。
Away’s New Series 3 Luggage Plays It Safe—That’s the Point
Away 的新款 Series 3 行李箱主打稳健设计
Away 推出的第三代行李箱保留了经典外观,但在轮系和伸缩手柄等细节上进行了技术升级,主打耐用与实用。
Anthropic Says It Discovered a Crispr-Like System. Now What?
Anthropic 称发现了一种 CRISPR 样系统,然后呢?
尽管 Anthropic 宣布了这一发现,但专家指出,实验尚在排队中,而公关宣传已先行一步,引发了对 AI 科学发现真实性的讨论。
OpenAI’s Dots Are Always-On AI Agents—and Its Answer to Meta’s Muse
OpenAI 的 Dots 是始终在线的 AI 智能体,也是对 Meta Muse 的回应
Dots 作为 OpenAI 的新产品,旨在通过连接应用和执行多步骤任务,成为用户的日常 AI 助手。
I Found National Coffee Day Deals Worth Making Coffee at Home For (2026)
我找到了值得在家制作咖啡的全国咖啡日优惠(2026)
文章盘点了 2026 年全国咖啡日的优惠活动,推荐了多款经过 WIRED 测试的咖啡机,鼓励用户在家享受高品质咖啡。
How to Beat Surveillance Pricing Before It Bleeds You Dry
如何在监控定价榨干你之前击败它
消费者权益倡导者 Lindsay Owen 在新书《Gouged》中揭示了企业如何利用软件和算法进行动态定价,并提供了应对策略。
7 Best Smartwatch Models: Apple, Google, Garmin (2026)
7 款最佳智能手表:苹果、谷歌、佳明(2026)
文章评测了 2026 年市面上最优秀的 7 款智能手表,重点关注其在减少手机依赖和保持连接方面的表现。
OpenAI Delays Release of Latest Model Over Safety Concerns
OpenAI 因安全担忧推迟发布最新模型
OpenAI 宣布推迟发布 Astra 模型,以进行更多的安全测试,并就此前澳大利亚政府服务器入侵事件道歉。
Timnit Gebru Believes There Is No ‘Existential Threat’ From AI
Timnit Gebru 认为 AI 不存在“生存威胁”
AI 领域的著名批评者 Timnit Gebru 认为,所谓的 AI 生存威胁论更多是创始人为了炒作和获利,而非真正为了拯救人类。
Lobsters
CoW — a stacking window manager for Wayland
CoW — Wayland 的堆叠窗口管理器
CoW 是一款为 Wayland 设计的堆叠窗口管理器,旨在提供简洁高效的窗口管理体验。
Pining for Arc Downcasting in Rust
渴望 Rust 中的 Arc 向下转型
文章讨论了在 Rust 中实现 Arc 向下转型的需求及其技术挑战。
Aho-Corasick Algorithm
Aho-Corasick 算法
文章介绍了 Aho-Corasick 字符串匹配算法的原理及其在高效文本处理中的应用。
My experience writing automated tests for a SPA
我为单页应用(SPA)编写自动化测试的经验
作者分享了在单页应用中实施自动化测试的挑战与心得,强调了测试策略的重要性。
Nura (postmarketOS): The road to daily-drivable mainline phones
Nura (postmarketOS):通往日常可用主线手机之路
文章介绍了 postmarketOS 项目在实现手机主线内核支持方面的进展,旨在让更多旧手机能够运行现代 Linux 系统。
The Shell & Email
Shell 与电子邮件
文章探讨了 Shell 环境与电子邮件系统的结合,展示了如何通过命令行高效管理邮件。
Bill Gates tries to install Movie Maker
比尔·盖茨尝试安装 Movie Maker
文章分享了一封关于比尔·盖茨早期尝试安装 Movie Maker 的技术邮件,具有历史趣味性。
Deser: Rethinking Rust Serialization
Deser:重新思考 Rust 序列化
文章介绍了 Deser 库,旨在通过重新设计序列化机制,提升 Rust 应用的性能与灵活性。
AI Didn’t Make Programming Easier. It Just Made It Differently Difficult
AI 没有让编程变得更容易,只是让它变得“困难得不同”
文章指出,AI 辅助编程虽然提升了效率,但也引入了新的复杂性和调试难度,编程的本质并未改变。
Switching To Emacs as a Neovim User
从 Neovim 用户切换到 Emacs
作者分享了从 Neovim 迁移到 Emacs 的心路历程,探讨了两者在配置与使用习惯上的差异。
DEV Community
From Sanity to Madness
从理智到疯狂
作者分享了利用 AI 生产团队编写视频脚本的经历,探讨了 AI 在创意工作中的局限性与意外表现。
Interfacing with Arduino Hardware: A Beginner’s Guide to Building a Custom EEPROM Programmer
Arduino 硬件接口:构建自定义 EEPROM 编程器的初学者指南
本文详细介绍了如何使用 Arduino 和 Python 构建一个自定义的 EEPROM 编程器,适合硬件编程初学者。
Native vs OCR PDF Text in Node.js: Choose Page Indexing by Ownership
Node.js 中的原生 PDF 文本与 OCR:根据所有权选择页面索引
文章对比了原生 PDF 文本提取与 OCR 技术,建议根据 PDF 模板的所有权选择最合适的索引方案。
Why Is OpenCSG More Than Just a “Chinese Version of Hugging Face”?
为什么 OpenCSG 不仅仅是“中国版 Hugging Face”?
文章分析了 OpenCSG 的定位,指出其在模型托管、开源协作及社区生态建设方面具有独特的价值,而非简单的模仿。
What I learned counting 600,000 live job adverts every night
我在每晚统计 60 万条实时招聘广告中学到的东西
作者分享了构建 TUNAI 招聘助手过程中,通过爬取和分析海量招聘数据所获得的行业洞察。
El cifrado whatsapp funciona. Entonces, ¿por qué se filtran los chats?
WhatsApp 加密有效,那为什么聊天记录还会泄露?
文章分析了 WhatsApp 端到端加密的安全性,指出聊天记录泄露通常源于终端安全问题而非加密协议本身。
ChatGPT Search Can Pre-Select Brands Before Retrieval, Research Shows
研究显示 ChatGPT 搜索可以在检索前预选品牌
研究发现,ChatGPT 在处理搜索请求时,会在检索网页结果前预先选择品牌,这引发了关于 AI 搜索中立性的讨论。
Settlement batches don’t know about daylight saving time
结算批次不知道夏令时
文章分享了一个因夏令时导致结算系统故障的案例,强调了在处理时间相关逻辑时考虑时区变化的必要性。
Your pull request review time is mostly waiting and rework
你的 PR 审查时间大部分花在等待和返工上
文章分析了代码审查的成本结构,指出 AI 辅助审查虽然能提升速度,但真正的瓶颈在于团队协作流程。
AI code review that follows your team’s rules: what each tool actually ingests
遵循团队规则的 AI 代码审查:工具实际摄入的内容
文章探讨了 AI 代码审查工具如何遵循团队编码标准,并分析了不同实现机制的