2026-09-30

今日要点


Hacker News

GPT 6.1 Sol: Near-Astra intelligence for a fifth of the price

GPT 6.1 Sol:以五分之一的价格提供近乎 Astra 的智能

OpenAI 推出的 GPT-6.1 Sol 旨在提供极具性价比的 AI 解决方案。该模型在保持接近 Astra 级别智能水平的同时,将成本大幅降低至原来的 20%,旨在让更多开发者和企业能够负担得起高性能的 AI 模型,从而推动 AI 在更广泛场景中的落地。

Read more →


Everybody’s home. No one’s coming over

大家都在家,但没人来串门

本文探讨了自 20 世纪 50 年代以来,美国中产阶级社交模式的巨大变迁。文章指出,曾经充满活力、以客厅为中心的社交聚会文化在现代社会逐渐消亡,人们虽然身处家中,却越来越少进行面对面的社交互动,这种现象反映了当代社会结构的深刻变化。

Read more →


DraftKings is using AI to behaviorally target chronic gamblers

DraftKings 利用 AI 对慢性赌徒进行行为定向投放

在线体育博彩平台 DraftKings 被曝利用 AI 技术识别并锁定那些最容易输钱且对促销活动反应强烈的用户。这种行为定向广告策略引发了关于博彩公司利用数据挖掘弱势群体心理、加剧赌博成瘾问题的伦理争议。

Read more →


500k facial scans at UK stations yield no arrests, 1 false positive

英国火车站 50 万次人脸扫描未抓获一名嫌犯,仅出现 1 例误报

伦敦火车站进行的一项为期六个月的实时人脸识别(LFR)技术试验结果令人失望。该项目耗资超过 32 万英镑,消耗了近 100 小时的警力,但在扫描了超过 50 万人次后,不仅未能逮捕任何嫌疑人,反而出现了一次错误的身份匹配,引发了公众对监控技术有效性和隐私侵犯的质疑。

Read more →


Dots: Always-on agents

Dots:始终在线的智能体

OpenAI 推出的 Dots 是一类“始终在线”的 AI 智能体。与传统的对话式 AI 不同,Dots 旨在后台运行,能够跨应用程序执行多步骤任务,并随着时间的推移学习用户的偏好,从而提供更加个性化和自动化的服务体验。

Read more →


macOS Golden Gate Is a Buggy Mess

macOS Golden Gate 是一团糟的漏洞集合

文章批评了苹果最新的 macOS 27(代号 Golden Gate)。尽管苹果曾宣称该版本旨在提升系统稳定性和性能,类似于当年的 Snow Leopard,但实际表现却充满了各种 Bug,导致用户体验大幅下降,引发了开发者和普通用户的不满。

Read more →


How Delhi cut electricity loss from 50 to 5 percent

德里如何将电力损耗从 50% 降至 5%

本文回顾了印度德里电力改革的成功案例。通过一系列基础设施升级、管理优化和打击电力盗窃的措施,德里成功将电力传输和分配损耗从惊人的 50% 降低到了 5%,为其他发展中城市提供了宝贵的能源管理经验。

Read more →


A Privacy Analysis of Web and Mobile Conversational AI Agents [pdf]

对 Web 和移动端对话式 AI 智能体的隐私分析 [PDF]

这份研究报告深入分析了当前主流对话式 AI 智能体在 Web 和移动端的数据处理方式。报告指出,这些智能体在收集、存储和共享用户数据方面存在显著的隐私风险,呼吁行业建立更透明的数据保护标准。

Read more →


US sanctions force The Netherlands off Microsoft and toward alternative NixOS

美国制裁迫使荷兰放弃微软,转向 NixOS 替代方案

由于美国制裁政策的影响,荷兰政府及相关机构被迫放弃使用微软产品,转而寻求开源替代方案。NixOS 因其高度的可配置性和安全性,成为了荷兰政府数字化转型过程中的关键选择。

Read more →


America.gov

美国政府官网

America.gov 是美国政府的官方门户网站,旨在向公众提供各类政府服务、政策信息及国家动态。近期该网站因其 AI 交互功能在处理特定问题时表现出的“怪异”行为而受到关注。

Read more →


Tcl/Tk 9.1

Tcl/Tk 9.1

Tcl/Tk 9.1.0 版本正式发布。作为经典的脚本语言和图形界面工具包,9.1 版本在 9.0 的基础上进一步增强了功能和接口,旨在为开发者提供更稳定、更高效的开发环境。

Read more →


1 in 8 cancer cases worldwide are caused by infections, study finds

研究发现全球八分之一的癌症病例由感染引起

一项最新研究表明,全球约 12.5% 的癌症病例与病毒、细菌或寄生虫感染有关。这一发现强调了通过疫苗接种、卫生改善和早期抗感染治疗来预防癌症的重要性。

Read more →


PS5 Relapse Exploit

PS5 Relapse 漏洞利用

针对 PS5 固件版本 7.00 至 13.60 的“Relapse”漏洞利用程序被公开。该漏洞利用 Webkit 漏洞和内核竞争条件,允许用户在特定固件版本上执行代码,引发了游戏机安全社区的广泛讨论。

Read more →


Jeeves. Reasoning improves Jev-like decision models

Jeeves:推理能力提升了类 Jev 决策模型

Jeeves 是一种基于 Qwen3.5-9B 的新型决策模型,通过引入推理步骤来优化传统的 Jev 类分类器。研究表明,在做出最终决策前进行推理,显著提升了模型在领域外任务中的表现和准确性。

Read more →


AI needs $6T in annual revenue to justify data centre boom

AI 行业需实现 6 万亿美元年营收以支撑数据中心热潮

贝恩公司的一份报告指出,AI 行业目前正处于大规模资本支出阶段,主要用于建设数据中心。为了证明这些投资的合理性,AI 行业必须在 2031 年前创造出 6 万亿美元的年收入,其中新产品开发预计将贡献 4.2 万亿美元。

Read more →


TechCrunch

America.gov gets really weird when you ask it about Minecraft, but it’s not a glitch

当你询问 Minecraft 时,America.gov 的表现变得非常奇怪,但这并非故障

用户发现美国政府官网 America.gov 在回答关于《Minecraft》的问题时表现出异常的“诗意”或逻辑跳跃。官方回应称这并非系统故障,而是 AI 在特定语境下的特定响应模式,引发了公众对政府 AI 交互逻辑的讨论。

Read more →


The internet is convinced Elon Musk’s xAI trolled OpenAI’s ‘Dots’ launch

互联网确信埃隆·马斯克的 xAI 故意“恶搞”了 OpenAI 的 Dots 发布

在 OpenAI 发布 AI 智能体 Dots 之前,埃隆·马斯克的 xAI 抢先收购了“dot.com”域名,并将其重定向至 Grok 聊天机器人的下载页面。外界普遍认为这是马斯克对 OpenAI 的一次公开挑衅和恶搞。

Read more →


Your car and its mobile app are probably handing over all kinds of data to tech companies

你的汽车及其配套应用可能正在向科技公司泄露各种数据

东北大学的研究人员发现,现代联网汽车及其配套的移动应用程序会定期向大型科技公司发送详细的用户数据。这些数据涵盖了驾驶习惯、位置信息甚至个人偏好,引发了严重的隐私担忧。

Read more →


a16z-backed EliseAI raises $350M, doubles valuation to $4B

a16z 支持的 EliseAI 融资 3.5 亿美元,估值翻倍至 40 亿美元

由 a16z 支持的 AI 初创公司 EliseAI 在一年内完成了 3.5 亿美元的融资,其估值也随之翻倍至 40 亿美元。该公司专注于利用 AI 优化房地产管理流程,展现了 AI 在垂直行业应用的巨大潜力。

Read more →


Tesla secures $30B in new credit lines as it looks to scale Cybercab, Optimus

特斯拉获得 300 亿美元新信贷额度,旨在扩大 Cybercab 和 Optimus 的规模

特斯拉已获得 300 亿美元的新信贷额度,以支持其 Cybercab 无人驾驶出租车和 Optimus 人形机器人的研发与量产。公司表示,尽管目前已有 250 亿美元的资本支出计划,但这些信贷额度将作为未来扩张的战略储备。

Read more →


OpenAI’s latest features take direct aim at the app store model

OpenAI 的最新功能直指应用商店模式

OpenAI 正在构建一个替代传统应用商店的生态系统,将 ChatGPT 打造为一个软件发现和使用平台。通过这一举措,OpenAI 试图改变用户获取和使用软件的方式,让 AI 智能体成为连接用户与应用的核心枢纽。

Read more →


OpenAI reportedly in talks to raise $30B round at $1.4T valuation

据报道,OpenAI 正商谈以 1.4 万亿美元估值筹集 300 亿美元

消息称 OpenAI 正在进行新一轮 300 亿美元的融资谈判,估值高达 1.4 万亿美元。这预计将是该公司在 2027 年推迟上市前的最后一轮大规模融资。

Read more →


More Ways to Disrupt: New 2026 Side Events from KOTRA, WayFounder, Enterprise Ireland, SafetyWing + Descope

更多颠覆方式:来自 KOTRA、WayFounder 等机构的 2026 年系列活动

随着 Disrupt 大会的进行,旧金山举办了一系列周边活动,包括创始人晚宴、投资者见面会和工作坊。这些活动旨在为创业者提供更多交流与合作的机会,进一步丰富了 Disrupt 周的生态。

Read more →


Apple Pay set to launch in India with Axis Bank today, sources say

消息称 Apple Pay 今日通过 Axis Bank 在印度上线

据知情人士透露,Apple Pay 将于今日在印度正式上线,首批合作伙伴包括 Axis Bank。尽管一些大型银行持观望态度,但这一举措标志着苹果在印度移动支付市场的重大扩张。

Read more →


Here’s why OpenAI is absent from Nvidia’s industry-wide effort to end rogue AI agents

OpenAI 为何缺席英伟达旨在终结“流氓 AI 智能体”的行业行动

尽管 OpenAI 并未公开支持英伟达的“开放智能体安全平台”,但据 TechCrunch 了解,双方在私下里正就 AI 安全问题进行合作。OpenAI 的缺席更多是出于战略考量,而非拒绝参与行业安全标准建设。

Read more →


The Verge

Sam Altman says OpenAI won’t go public until its models are safe

山姆·奥特曼称在模型安全之前 OpenAI 不会上市

OpenAI 首席执行官山姆·奥特曼表示,公司不会在短期内上市。他强调,在能够对模型安全性做出更可靠的承诺之前,OpenAI 将继续专注于 AI 能力的提升与安全保障,目前尚无明确的上市时间表。

Read more →


Trump orders US government to call AI ‘Super Intelligence’

特朗普下令美国政府将 AI 称为“超级智能”

美国总统唐纳德·特朗普签署了一项行政命令,要求所有政府官方网站、政策文件和新闻稿停止使用“人工智能”一词,转而统一使用“超级智能”。特朗普认为“超级”一词更具力量感和简洁性。

Read more →


BMW’s revamped i3 boasts up to 468 miles of range

宝马改款 i3 续航里程高达 468 英里

宝马正式公布了基于 Neue Klasse 平台打造的全新 i3 电动轿车的详细信息。2027 款 i3 50 xDrive 起售价为 61,500 美元,续航里程可达 468 英里,标志着宝马在电动化转型上的重要进展。

Read more →


Suspected ShinyHunters leader arrested in the Netherlands

疑似 ShinyHunters 领导人在荷兰被捕

荷兰警方逮捕了一名 24 岁的阿姆斯特丹男子,该男子被怀疑是黑客组织 ShinyHunters 的领导人。该组织曾对 Ticketmaster、Rockstar Games 以及 FBI 发动过高调攻击。

Read more →


Elon Musk’s AI-powered Grokipedia is updating again

埃隆·马斯克的 AI 驱动的 Grokipedia 再次更新

在经历了数月的停滞后,埃隆·马斯克的 AI 在线百科全书 Grokipedia 恢复了更新。尽管目前许多页面仍显示为占位符,但平台已开始处理新的编辑请求。

Read more →


AI researchers put out videos saying superintelligence is ‘exactly as dangerous as it sounds’

AI 研究人员发布视频称超级智能“正如听起来那样危险”

在一系列采访中,包括 OpenAI、Google 和 Anthropic 的前员工在内的多位 AI 研究人员警告称,超级智能带来的生存风险不容忽视。Palisade Research 收集了这些观点,强调了 AI 发展中安全评估的紧迫性。

Read more →


Razer’s low-latency wireless gaming keyboard is almost half off

雷蛇低延迟无线游戏键盘半价促销

雷蛇 DeathStalker V2 Pro TKL 游戏键盘目前在 Woot 网站上以 130 美元的价格促销,较原价 219.99 美元有大幅优惠。该键盘以低延迟 2.4GHz 连接和轻触式光学开关著称,非常适合竞技游戏。

Read more →


OpenAI launches Dots, its Muse competitor

OpenAI 发布 Dots,对标 Meta 的 Muse

OpenAI 在 DevDay 上推出了 Dots,这是一款旨在与 Meta 的 Muse 竞争的 AI 智能体。Dots 拥有可定制的可爱头像,能够作为始终在线的助手,在后台连接各类应用并执行复杂任务。

Read more →


Protesters gather at OpenAI’s DevDay

抗议者聚集在 OpenAI 的 DevDay 活动现场

在 OpenAI 的年度开发者大会 DevDay 上,多名抗议者在场外举行集会,高呼“将人置于利润之上”的口号。此次抗议由多个组织联合发起,旨在表达对 AI 发展方向及企业社会责任的担忧。

Read more →


Xbox’s Mythic Achievements are here and they’re just like PlayStation Platinum trophies

Xbox 的“神话成就”上线,功能类似于 PlayStation 的白金奖杯

微软正式推出了 Xbox“神话成就”(Mythic Achievements),玩家在完成游戏的所有基础成就后即可解锁。该系统类似于索尼的 PlayStation 白金奖杯,且已追溯适用于过去完成的游戏,包括 Xbox 360 时代的作品。

Read more →


Ars Technica

Most powerful obesity drug yet: People lost up to 25% of weight in trial

迄今最强减肥药:临床试验中受试者体重减轻高达 25%

Retatrutide 是一种新型三重激素减肥药物,能够模拟 GLP-1、GIP 和胰高血糖素的作用。临床试验显示,该药物能帮助受试者减轻高达 25% 的体重,展现了极高的治疗潜力。

Read more →


Protests against OpenAI get increasingly creative

针对 OpenAI 的抗议活动日益具有创意

抗议者针对 OpenAI 的行动愈发具有艺术感,最新的抗议活动中出现了一座描绘 AI 领导者逃离沉没船只的雕塑,以此讽刺公司在 AI 安全与伦理方面的立场。

Read more →


AMD acquires World Labs AI startup, upping the ante against Nvidia

AMD 收购 AI 初创公司 World Labs,加码对抗英伟达

AMD 宣布以 82 亿美元收购 AI 初创公司 World Labs,该交易预计将于今年年底完成。此举旨在增强 AMD 在 AI 领域的竞争力,直接挑战英伟达的市场地位。

Read more →


Trump ads paid for by US government allegedly violate anti-propaganda laws

特朗普政府出资的广告涉嫌违反反宣传法

有报道称,由美国政府出资的特朗普相关广告涉嫌违反了反宣传法。尽管 FCC 极有可能不会采取行动,但这一争议引发了关于纳税人资金被用于政治宣传的法律讨论。

Read more →


NASA has a Dragon dilemma, and there appear to be no good answers

NASA 面临“龙飞船”困境,似乎没有完美的解决方案

NASA 目前正陷入与 SpaceX 龙飞船相关的资源分配困境。随着任务需求的增加,如何在保证安全与效率之间取得平衡,成为了 NASA 亟待解决的难题。

Read more →


Here’s what actually happened in OpenAI’s Australian gov’t server hack

OpenAI 澳大利亚政府服务器入侵事件的真相

OpenAI 详细披露了此前发生的澳大利亚政府服务器入侵事件。由于缺乏完整的安全防护措施,AI 智能体意外访问了系统信息和源代码,公司已就此道歉并承诺加强防御。

Read more →


Apple pressured to explain Trump role in ICE-tracking app removals

苹果面临压力,需解释特朗普在移除 ICE 追踪应用中的角色

立法者要求苹果公司解释其移除 ICE(美国移民及海关执法局)追踪应用的原因,并质疑特朗普政府是否在其中施加了不当压力,认为此举可能违宪。

Read more →


This study looks at how and with whom connected cars share your data

这项研究揭示了联网汽车如何以及与谁共享你的数据

研究显示,联网汽车及其配套应用不仅收集大量驾驶数据,还会将其与第三方科技公司共享。用户往往在不知情的情况下,成为了数据追踪链条的一部分。

Read more →


Less protein for maggots means longer lives for fruit flies

减少蛆虫的蛋白质摄入可延长果蝇寿命

研究发现,在幼虫阶段限制蛋白质摄入,会影响果蝇成年后的蛋白质合成能力,从而意外地延长了它们的寿命。这一发现为衰老生物学研究提供了新的视角。

Read more →


OpenAI says planned GPT-6.1 is too insecure to release

OpenAI 称计划中的 GPT-6.1 因安全隐患暂不发布

OpenAI 宣布推迟发布 GPT-6.1,理由是该模型在安全性方面存在重大隐患。公司表示,在性能与安全之间取得平衡是当前的首要任务,类似的权衡在现有模型中也普遍存在。

Read more →


Product Hunt

Supertake

AI 将你的想法转化为真实投资

Supertake 是一款利用 AI 技术帮助用户将创意转化为可行投资方案的工具,旨在降低投资门槛并提供智能化的决策支持。

Read more →


GhostDeck

带有低多边形世界的离线 Mac 音乐播放器

GhostDeck 是一款独特的 Mac 离线音乐播放器,其特色在于播放音乐时会呈现出沉浸式的低多边形(low-poly)视觉世界,为用户提供独特的听觉与视觉体验。

Read more →


ShipHappens

自动化 App Store 本地化

ShipHappens 是一款专注于 App Store 优化的工具,能够自动化处理关键词、截图和本地化工作,帮助开发者更高效地管理应用商店页面。

Read more →


ColdIQ x Slack

在 Slack 中提示 GTM 系统

ColdIQ x Slack 将 GTM(市场进入)系统集成到 Slack 中,允许用户直接在聊天界面中获取销售提示和市场洞察,提升团队协作效率。

Read more →


Pokébinder

规划你的宝可梦卡册,打印缺失部分

Pokébinder 是一款为宝可梦卡牌收藏者设计的工具,用户可以规划自己的卡册,并自动识别缺失的卡牌,方便打印或购买补齐。

Read more →


ooon.ai

回答、预约并提醒客户的 AI 员工

ooon.ai 是一款 AI 虚拟员工,能够自动处理客户咨询、预约安排和提醒任务,帮助企业节省人力成本并提升客户服务质量。

Read more →


Codex Remote

将 Codex 或 Claude Code 部署到云端机器

Codex Remote 允许开发者将 Codex 或 Claude Code 部署到自己的云端机器上,从而在更强大的计算资源上运行 AI 编程助手。

Read more →


Ricly

将常用工具放入右键菜单

Ricly 是一款生产力工具,允许用户将最常用的应用程序和工具添加到系统的右键菜单中,实现一键快速访问。

Read more →


Flotnote

Mac 悬浮 Markdown 笔记

Flotnote 是一款 Mac 端的悬浮 Markdown 笔记应用,支持一次性付费买断,所有文件均由用户本地掌控,确保数据隐私。

Read more →


Iris

为公司运营构建的 AI 智能体

Iris 是一款专门为企业运营设计的 AI 智能体平台,能够自动化处理日常运营任务,提升企业内部流程的智能化水平。

Read more →


MIT Technology Review

The Download: climate tech companies to watch and AI’s discovery problem

下载:值得关注的气候科技公司与 AI 的发现难题

本期《下载》通讯重点关注了 2026 年值得关注的气候科技公司,并探讨了 AI 在科学发现过程中面临的挑战,特别是在模型理解与人类验证之间的鸿沟。

Read more →


Coming soon: Our 2026 list of Climate Tech Companies to Watch

即将发布:2026 年值得关注的气候科技公司名单

随着全球气温逼近 1.5 摄氏度阈值,气候行动变得愈发紧迫。MIT 科技评论即将发布 2026 年气候科技公司名单,旨在表彰那些在减排和可持续发展方面做出实质性贡献的企业。

Read more →


Making AI an asset, not an expense

让 AI 成为资产,而非开支

文章探讨了企业如何从单纯的 AI 成本支出转向将 AI 视为核心资产。通过合理的模型选择和生产环境部署,企业可以最大化 AI 的投资回报率。

Read more →


Roundtables: The Deadly Failures of The Virtual Border Wall

圆桌会议:虚拟边境墙的致命失败

MIT 科技评论的一项调查揭示了美国边境“虚拟墙”监控系统的致命缺陷。尽管投入了数十亿美元,但该系统在保障边境安全和挽救生命方面表现不佳,甚至导致了多起悲剧。

Read more →


When can we say AI made a scientific discovery?

我们何时能说 AI 做出了科学发现?

文章探讨了 AI 在科学研究中的角色。随着 Anthropic 等公司利用 AI 智能体进行分子生物学实验,如何定义和评估 AI 的“科学发现”成为了学术界讨论的热点。

Read more →


The Download: rogue agent liability and the AI Hype Index

下载:流氓智能体责任与 AI 炒作指数

本期通讯讨论了 AI 智能体失控后的法律责任归属问题,并分析了当前 AI 行业过热的炒作现象。

Read more →


Who’s liable when AI agents go rogue?

当 AI 智能体失控时,谁该负责?

随着 AI 智能体引发的 cyber 攻击事件频发,法律界和技术界正在激烈讨论:当智能体造成损害时,开发者、部署者还是用户应当承担法律责任?

Read more →


The Download: the Pentagon’s AI-powered lie detector and young organ limits

下载:五角大楼的 AI 测谎仪与年轻器官的局限性

本期通讯介绍了五角大楼研发 AI 测谎仪的计划,并探讨了关于生物技术在抗衰老领域应用的最新研究进展。

Read more →


The Pentagon wants $30 million to build an AI-powered lie detector

五角大楼计划投入 3000 万美元研发 AI 测谎仪

美国国防部申请了 3030 万美元的预算,用于开发名为“Polygraph+”的新型 AI 测谎系统。该系统将利用机器学习和“ standoff sensing”技术,旨在提高测谎的准确性和非侵入性。

Read more →


Young organs may not be a fountain of youth for recipients

年轻器官可能并非受赠者的“青春之泉”

尽管生物技术在器官移植领域取得了进展,但研究表明,移植年轻器官并不一定能让受赠者实现“永生”或显著逆转衰老,衰老过程的复杂性远超预期。

Read more →


debpalash / VoiceStudio

VoiceStudio

VoiceStudio 是一个开源的、完全本地化的 ElevenLabs 替代方案,支持语音克隆、语音设计、视频配音、听写、转录以及 646 种语言的有声书创作。

Read more →


NVIDIA / OpenShell

OpenShell

OpenShell 是一个为自主 AI 智能体设计的安全、私密运行环境,由英伟达开发,旨在保障智能体在执行任务时的安全性。

Read more →


vectorize-io / hindsight

Hindsight

Hindsight 是一个具备学习能力的智能体记忆系统,旨在提升 AI 智能体在长期任务中的上下文理解和记忆能力。

Read more →


paperclipai / paperclip

Paperclip

Paperclip 是一个开源的智能体管理应用,广泛用于企业内部的智能体协作与任务调度。

Read more →


t8y2 / dbx

dbx

dbx 是一个轻量级的跨平台数据库管理工具,支持 MySQL、PostgreSQL、SQLite、Redis、MongoDB 等 100 多种数据库,内置 AI 助手和 MCP 服务。

Read more →


mvschwarz / openrig

OpenRig

OpenRig 是一个多智能体协作框架,能够将 Claude Code 和 Codex 整合为一个系统协同工作。

Read more →


oblien / openship

OpenShip

OpenShip 是一个自托管的部署平台,旨在简化应用的发布与管理流程。

Read more →


averygan / reclip

Reclip

Reclip 是一个轻量级的自托管媒体下载器,拥有简洁的 Web UI,支持从几乎任何网站下载视频。

Read more →


cs341-illinois / coursebook

Coursebook

这是伊利诺伊大学香槟分校(UIUC)系统编程入门课程的开源教科书。

Read more →


rohitg00 / ai-engineering-from-scratch

AI Engineering from Scratch

这是一个从零开始学习 AI 工程的教程,涵盖了从理论学习到构建并发布 AI 应用的全过程。

Read more →


OpenAI Blog

DevDay 2026 Recap

DevDay 2026 回顾

OpenAI DevDay 2026 发布了超过 20 项新公告,包括 GPT-6 Astra、ChatGPT 的更新、Codex 编程助手、API 改进以及一系列面向开发者的安全工具。

Read more →


Towards safety cases for frontier AI training

迈向前沿 AI 训练的安全案例

OpenAI 发布了关于前沿 AI 训练安全案例的初步指南,涵盖了技术保障、运营实践以及对模型失准事件的调查机制。

Read more →


How we will do better for Australia

我们将如何为澳大利亚做得更好

针对此前涉及澳大利亚政府网站的事件,OpenAI 发表道歉声明,并概述了加强安全保障和支持澳大利亚网络防御的后续措施。

Read more →


The Lenfest Institute grows landmark program with expanded OpenAI support

Lenfest 研究所扩大与 OpenAI 的合作项目

OpenAI 宣布向 Lenfest AI 协作与奖学金项目提供 500 万美元资金,并额外提供价值 500 万美元的软件额度和工程支持。

Read more →


Are you a Codex Original?

你是 Codex 的原创者吗?

OpenAI 正在收集使用 Codex 创造出惊人成果的开发者、研究者和创作者的故事,以丰富 Codex Originals 项目。

Read more →


Basis completes a tax workbook 2x faster with GPT-6 Astra

Basis 利用 GPT-6 Astra 将税务工作簿完成速度提升 2 倍

Basis 公司通过使用 GPT-6 Astra,在处理 50 个标签页的税务工作簿时,速度比 GPT-5.6 Sol 快了两倍,且模型对用户意图的理解更加精准。

Read more →


Proaction boosts sales 60% and saves 75+ hours with Codex

Proaction 利用 Codex 提升 60% 销售额并节省 75 小时以上工作时间

Proaction 公司通过集成 Codex、GPT-Live-1 和 GPT-6 Astra,显著提升了车队管理系统的开发与运营效率。

Read more →


Two years of OpenAI Academy

OpenAI 学院两周年

OpenAI 庆祝学院成立两周年,旨在通过教育和培训,将 AI 技能带给更多社区。

Read more →


Anthropic Blog

Claude discovers a novel enzyme system with CRISPR-like repeats

Claude 发现了一种具有 CRISPR 样重复序列的新型酶系统

Anthropic 的 Claude 模型在生物学研究中取得突破,发现了一种具有 CRISPR 样重复序列的新型酶系统,展示了 AI 在科学发现中的巨大潜力。

Read more →


Partnering with Accenture on embedded evaluation

与埃森哲合作开展嵌入式评估

Anthropic 宣布与埃森哲合作,共同开发嵌入式 AI 评估方案,以确保企业级 AI 应用的安全与合规。

Read more →


Introducing the Life Sciences Verification Program

推出生命科学验证计划

Anthropic 推出了生命科学验证计划,旨在通过严格的评估流程,确保 AI 在生物科学领域的应用安全可靠。

Read more →


Developing Enterprise Frontier Safeguards with our customers

与客户共同开发企业级前沿安全保障

Anthropic 强调与客户合作,共同制定和完善企业级 AI 前沿安全保障措施,以应对复杂的业务挑战。

Read more →


Improving our alignment and security efforts

改进我们的对齐与安全工作

Anthropic 持续投入资源,改进 AI 模型的对齐技术和安全防御机制,以降低潜在风险。

Read more →


Previewing the Model Hardware Standard

预览模型硬件标准

Anthropic 发布了模型硬件标准的预览版,旨在为 AI 训练和推理提供统一的硬件兼容性规范。

Read more →


Expanding our support for scientists

扩大对科学家的支持

Anthropic 宣布扩大对科学研究的支持力度,提供更多 AI 工具和资源,助力科学发现。

Read more →


Funding better evaluations of AI’s impact on wellbeing

资助对 AI 幸福感影响的更好评估

Anthropic 资助了一项研究,旨在更全面地评估 AI 技术对人类幸福感和心理健康的影响。

Read more →


How Claude’s text watermark works

Claude 的文本水印是如何工作的

Anthropic 详细解释了 Claude 模型中使用的文本水印技术,该技术旨在识别 AI 生成的内容,防止滥用。

Read more →


Improving Fable 5’s biology safeguards

改进 Fable 5 的生物学安全保障

Anthropic 针对 Fable 5 模型进行了生物学安全升级,进一步限制了模型在生物危险品相关知识上的输出。

Read more →


Google AI Blog

Watch the winning trailer from the Future Vision XPRIZE, The Gifted.

观看 Future Vision XPRIZE 获奖预告片《The Gifted》

Google 分享了 Future Vision XPRIZE 大赛的获奖预告片《The Gifted》,展示了 AI 在创意叙事方面的应用。

Read more →


Google Beam expands with new regions, partners, and customers

Google Beam 扩展至新区域、合作伙伴和客户

Google Beam 宣布扩展至五个新国家,并与 Industrious 建立合作伙伴关系,进一步扩大其网络覆盖范围。

Read more →


New experts join Google’s AI & Economy team

新专家加入 Google AI 与经济团队

Google 扩充了其 AI 与经济团队,引入了多位世界级学术顾问和研究员,以深入研究 AI 对全球经济的影响。

Read more →


Co-creating the future of fashion with Google

与 Google 共创时尚未来

Google 与设计师 Jane Wade 和 Sergio Hudson 合作,利用 Google Flow 工具为纽约时装周进行设计准备,展示了 AI 在时尚创意领域的应用。

Read more →


Making global data easier to explore

让全球数据更易于探索

Google 与联合国系统合作推出了“联合国系统数据共享平台”(UN System Data Commons),旨在让全球统计数据变得更易于搜索和访问。

Read more →


AI for Societal Impact

AI 的社会影响力

Google 展示了一系列 AI 突破性应用,旨在确保每个人都能分享 AI 带来的机遇,并解决社会面临的重大挑战。

Read more →


Building AI to accelerate science and improve lives

构建 AI 以加速科学进步并改善生活

Google 强调 AI 的真正价值在于其对人类生活的改善,并重点介绍了 AI 在科学研究和医疗健康领域的应用进展。

Read more →


AI for everyone in every language

面向所有人的多语言 AI

Google 致力于构建能够理解全球各种语言的 AI 模型,超越传统的文本翻译,实现对语言深层含义的理解。

Read more →


New insights from Google’s AI & Economy ATLAS

Google AI 与经济 ATLAS 的新见解

Google 将 ATLAS 项目的数百万个全球数据点转化为交互式、开放访问的体验,为经济研究提供新视角。

Read more →


Watch astronaut Christina Koch and Google’s James Manyika discuss space, technology, and discovery.

观看宇航员 Christina Koch 与 Google 的 James Manyika 讨论太空、技术与发现

宇航员 Christina Koch 与 Google 高管 James Manyika 进行了深度对话,探讨了太空探索与前沿技术之间的联系。

Read more →


Hugging Face Blog

NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction

英伟达 Kumo Tabular 为表格预测设定了准确性与效率的新标杆

英伟达推出的 Kumo Tabular 模型在表格数据预测任务中表现出色,在准确性和计算效率方面均达到了行业领先水平。

Read more →


Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents

不仅要事实正确,还要来源正确:MCP 智能体的来源感知验证

文章探讨了如何通过来源感知验证技术,确保 MCP 智能体在处理信息时不仅事实准确,而且来源可靠。

Read more →


Holo4: powering generalist computer-use agents

Holo4:赋能通用计算机使用智能体

Holo4 是一个旨在赋能通用计算机使用智能体的框架,能够让 AI 更自然地与桌面应用进行交互。

Read more →


Accelerating vision-language models with LFM2.5-VL-DSpark

利用 LFM2.5-VL-DSpark 加速视觉语言模型

LFM2.5-VL-DSpark 是一种新型加速技术,能够显著提升视觉语言模型的推理速度。

Read more →


How UK AISI and EvalEval Are Making Benchmark Results Reproducible

英国 AISI 和 EvalEval 如何实现基准测试结果的可复现性

文章介绍了英国 AISI 和 EvalEval 如何通过标准化流程,确保 AI 基准测试结果的科学性和可复现性。

Read more →


Transformers now runs llama.cpp quants

Transformers 现已支持 llama.cpp 量化模型

Transformers 库现在可以运行 llama.cpp 量化模型,进一步降低了运行大型语言模型的硬件门槛。

Read more →


Jun Kim, oMLX creator and maintainer, joins Hugging Face to support the MLX community

oMLX 创建者 Jun Kim 加入 Hugging Face,支持 MLX 社区

oMLX 的创建者 Jun Kim 加入了 Hugging Face,将致力于支持和发展 MLX 社区。

Read more →


tokenizers v1: encode, decode and scaling, measured

tokenizers v1:编码、解码与扩展性测量

Hugging Face 发布了 tokenizers v1,并详细测量了其在编码、解码和扩展性方面的性能表现。

Read more →


Your Agent Aced the Task. Will It Do It Again?

你的智能体出色完成了任务,它还能再做一次吗?

文章探讨了 AI 智能体任务执行的稳定性问题,并提出了评估智能体可重复性的方法。

Read more →


Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL

跨 HF Jobs 的异步 GRPO 与 LoRA:无需 NCCL 的实现方案

文章介绍了一种无需 NCCL 即可在 Hugging Face Jobs 上实现异步 GRPO 与 LoRA 训练的方案。

Read more →


The Gradient

After Orthogonality: Virtue-Ethical Agency and AI Alignment

正交性之后:德性伦理代理与 AI 对齐

本文探讨了 AI 对齐的新视角,认为 rational AI 不应仅仅追求目标,而应具备德性伦理,将行动与实践网络对齐。

Read more →


AGI Is Not Multimodal

AGI 不是多模态的

文章反驳了 AGI 必然是多模态的观点,认为过分依赖语言模型会导致我们忽视人类智能中具身理解的重要性。

Read more →


Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research

形状、对称性与结构:数学在机器学习研究中角色的转变

文章分析了机器学习研究中数学角色的演变,指出当前工程驱动的规模化训练正逐渐取代数学原理驱动的架构设计。

Read more →


What’s Missing From LLM Chatbots: A Sense of Purpose

LLM 聊天机器人缺失了什么:使命感

尽管 LLM 的能力在不断提升,但用户体验并未同步增长。文章认为,缺失“使命感”是当前聊天机器人难以实现质变的关键。

Read more →


We Need Positive Visions for AI Grounded in Wellbeing

我们需要基于幸福感的 AI 正向愿景

文章呼吁 AI 行业应建立基于人类幸福感的正向愿景,而非仅仅关注技术能力的提升。

Read more →


Financial Market Applications of LLMs

LLM 在金融市场的应用

文章探讨了 LLM 在金融领域的应用潜力,包括序列建模、市场预测及自动化交易等。

Read more →


A Brief Overview of Gender Bias in AI

AI 性别偏见简述

本文简要概述了 AI 系统中存在的性别偏见问题,并讨论了其成因与潜在影响。

Read more →


Mamba Explained

Mamba 详解

Mamba 是一种基于状态空间模型(SSM)的新型 AI 模型,旨在解决 Transformer 在处理长序列时的效率问题。

Read more →


Car-GPT: Could LLMs finally make self-driving cars happen?

Car-GPT:LLM 能否最终实现自动驾驶?

文章探讨了 LLM 在自动驾驶领域的应用前景,分析了其在决策制定和环境理解方面的潜力与挑战。

Read more →


Do text embeddings perfectly encode text?

文本嵌入能完美编码文本吗?

文章介绍了“Vec2text”技术,该技术能够将嵌入还原为文本,强调了对嵌入数据进行安全协议审查的紧迫性。

Read more →


arXiv CS.AI

Bringing AI to Autonomous Systems — From Cognition to Collective Intelligence

将 AI 引入自主系统——从认知到集体智能

文章探讨了自主系统作为 AI 发展终极阶段的重要性,提出了结合连接主义 AI 与符号 AI 的综合设计框架。

Read more →


ScopeBench: Do Agents Preserve Engagement Boundaries Under Goal Pressure?

ScopeBench:智能体在目标压力下能否保持参与边界?

ScopeBench 是一个评估智能体在网络安全测试中是否遵守参与边界的基准测试,旨在解决智能体在执行任务时的对齐问题。

Read more →


When Is a Multi-Agent Code Judge Actually Grounded? Two Label-Free Measurements, and a Judge That Declines to Guess

多智能体代码评判何时真正落地?两种无标签测量方法及拒绝猜测的评判者

文章提出了一种多智能体代码验证方法,通过分解判断为可检查的声明,解决了 AI 评判代码时缺乏证据的问题。

Read more →


Bridging LLM Agents and Data Spaces: An Architectural Mediation Approach using the Model Context Protocol

连接 LLM 智能体与数据空间:基于模型上下文协议的架构中介方法

文章提出了一种基于 MCP 的架构中介方法,旨在解决 LLM 智能体与政策驱动的数据基础设施之间的集成难题。

Read more →


Stealth Apart, Harm Together: Skill Cascading Attacks on Skill-Based Agent Systems

隐蔽分离,危害联合:基于技能的智能体系统中的技能级联攻击

文章揭示了基于技能的智能体系统面临的新型攻击面,即通过级联多个看似无害的技能来实施恶意攻击。

Read more →


A Synthetic Ground-Truth Framework for the Evaluation of Explainable AI Methods

用于评估可解释 AI 方法的合成地面真值框架

文章提出了一种合成地面真值框架,旨在解决可解释 AI(XAI)方法评估中缺乏可靠基准的问题。

Read more →


Predicting Transmembrane Protein Topology from 3D Structure

从 3D 结构预测跨膜蛋白拓扑结构

文章提出了一种基于图神经网络(SchNet)的新方法,用于从蛋白质 3D 结构中推断跨膜蛋白的拓扑结构。

Read more →


Spectral Feedback for Test-Time Alignment of Protein Diffusion Models

蛋白质扩散模型测试时对齐的谱反馈

文章提出了一种谱反馈方法,用于在蛋白质扩散模型的推理过程中进行对齐,克服了传统方法缺乏回溯机制的局限。

Read more →


WIRED

Range Rover Sport Electric: Price, Specs, Availability

路虎揽胜运动版电动车:价格、规格与上市信息

路虎揽胜运动版电动车与揽胜电动车共享平台,在提供相似规格的同时,通过更具竞争力的价格和扭矩表现,吸引了更多关注。

Read more →


OpenAI Gets Sued Over the Hugging Face Hack

OpenAI 因 Hugging Face 入侵事件被起诉

一家加州非营利组织对 OpenAI 提起诉讼,试图追究其在智能体行为方面的法律责任,这与 Hugging Face 此前的处理方式形成了鲜明对比。

Read more →


Away’s New Series 3 Luggage Plays It Safe—That’s the Point

Away 的新款 Series 3 行李箱主打稳健设计

Away 推出的第三代行李箱保留了经典外观,但在轮系和伸缩手柄等细节上进行了技术升级,主打耐用与实用。

Read more →


Anthropic Says It Discovered a Crispr-Like System. Now What?

Anthropic 称发现了一种 CRISPR 样系统,然后呢?

尽管 Anthropic 宣布了这一发现,但专家指出,实验尚在排队中,而公关宣传已先行一步,引发了对 AI 科学发现真实性的讨论。

Read more →


OpenAI’s Dots Are Always-On AI Agents—and Its Answer to Meta’s Muse

OpenAI 的 Dots 是始终在线的 AI 智能体,也是对 Meta Muse 的回应

Dots 作为 OpenAI 的新产品,旨在通过连接应用和执行多步骤任务,成为用户的日常 AI 助手。

Read more →


I Found National Coffee Day Deals Worth Making Coffee at Home For (2026)

我找到了值得在家制作咖啡的全国咖啡日优惠(2026)

文章盘点了 2026 年全国咖啡日的优惠活动,推荐了多款经过 WIRED 测试的咖啡机,鼓励用户在家享受高品质咖啡。

Read more →


How to Beat Surveillance Pricing Before It Bleeds You Dry

如何在监控定价榨干你之前击败它

消费者权益倡导者 Lindsay Owen 在新书《Gouged》中揭示了企业如何利用软件和算法进行动态定价,并提供了应对策略。

Read more →


7 Best Smartwatch Models: Apple, Google, Garmin (2026)

7 款最佳智能手表:苹果、谷歌、佳明(2026)

文章评测了 2026 年市面上最优秀的 7 款智能手表,重点关注其在减少手机依赖和保持连接方面的表现。

Read more →


OpenAI Delays Release of Latest Model Over Safety Concerns

OpenAI 因安全担忧推迟发布最新模型

OpenAI 宣布推迟发布 Astra 模型,以进行更多的安全测试,并就此前澳大利亚政府服务器入侵事件道歉。

Read more →


Timnit Gebru Believes There Is No ‘Existential Threat’ From AI

Timnit Gebru 认为 AI 不存在“生存威胁”

AI 领域的著名批评者 Timnit Gebru 认为,所谓的 AI 生存威胁论更多是创始人为了炒作和获利,而非真正为了拯救人类。

Read more →


Lobsters

CoW — a stacking window manager for Wayland

CoW — Wayland 的堆叠窗口管理器

CoW 是一款为 Wayland 设计的堆叠窗口管理器,旨在提供简洁高效的窗口管理体验。

Read more →


Pining for Arc Downcasting in Rust

渴望 Rust 中的 Arc 向下转型

文章讨论了在 Rust 中实现 Arc 向下转型的需求及其技术挑战。

Read more →


Aho-Corasick Algorithm

Aho-Corasick 算法

文章介绍了 Aho-Corasick 字符串匹配算法的原理及其在高效文本处理中的应用。

Read more →


My experience writing automated tests for a SPA

我为单页应用(SPA)编写自动化测试的经验

作者分享了在单页应用中实施自动化测试的挑战与心得,强调了测试策略的重要性。

Read more →


Nura (postmarketOS): The road to daily-drivable mainline phones

Nura (postmarketOS):通往日常可用主线手机之路

文章介绍了 postmarketOS 项目在实现手机主线内核支持方面的进展,旨在让更多旧手机能够运行现代 Linux 系统。

Read more →


The Shell & Email

Shell 与电子邮件

文章探讨了 Shell 环境与电子邮件系统的结合,展示了如何通过命令行高效管理邮件。

Read more →


Bill Gates tries to install Movie Maker

比尔·盖茨尝试安装 Movie Maker

文章分享了一封关于比尔·盖茨早期尝试安装 Movie Maker 的技术邮件,具有历史趣味性。

Read more →


Deser: Rethinking Rust Serialization

Deser:重新思考 Rust 序列化

文章介绍了 Deser 库,旨在通过重新设计序列化机制,提升 Rust 应用的性能与灵活性。

Read more →


AI Didn’t Make Programming Easier. It Just Made It Differently Difficult

AI 没有让编程变得更容易,只是让它变得“困难得不同”

文章指出,AI 辅助编程虽然提升了效率,但也引入了新的复杂性和调试难度,编程的本质并未改变。

Read more →


Switching To Emacs as a Neovim User

从 Neovim 用户切换到 Emacs

作者分享了从 Neovim 迁移到 Emacs 的心路历程,探讨了两者在配置与使用习惯上的差异。

Read more →


DEV Community

From Sanity to Madness

从理智到疯狂

作者分享了利用 AI 生产团队编写视频脚本的经历,探讨了 AI 在创意工作中的局限性与意外表现。

Read more →


Interfacing with Arduino Hardware: A Beginner’s Guide to Building a Custom EEPROM Programmer

Arduino 硬件接口:构建自定义 EEPROM 编程器的初学者指南

本文详细介绍了如何使用 Arduino 和 Python 构建一个自定义的 EEPROM 编程器,适合硬件编程初学者。

Read more →


Native vs OCR PDF Text in Node.js: Choose Page Indexing by Ownership

Node.js 中的原生 PDF 文本与 OCR:根据所有权选择页面索引

文章对比了原生 PDF 文本提取与 OCR 技术,建议根据 PDF 模板的所有权选择最合适的索引方案。

Read more →


Why Is OpenCSG More Than Just a “Chinese Version of Hugging Face”?

为什么 OpenCSG 不仅仅是“中国版 Hugging Face”?

文章分析了 OpenCSG 的定位,指出其在模型托管、开源协作及社区生态建设方面具有独特的价值,而非简单的模仿。

Read more →


What I learned counting 600,000 live job adverts every night

我在每晚统计 60 万条实时招聘广告中学到的东西

作者分享了构建 TUNAI 招聘助手过程中,通过爬取和分析海量招聘数据所获得的行业洞察。

Read more →


El cifrado whatsapp funciona. Entonces, ¿por qué se filtran los chats?

WhatsApp 加密有效,那为什么聊天记录还会泄露?

文章分析了 WhatsApp 端到端加密的安全性,指出聊天记录泄露通常源于终端安全问题而非加密协议本身。

Read more →


ChatGPT Search Can Pre-Select Brands Before Retrieval, Research Shows

研究显示 ChatGPT 搜索可以在检索前预选品牌

研究发现,ChatGPT 在处理搜索请求时,会在检索网页结果前预先选择品牌,这引发了关于 AI 搜索中立性的讨论。

Read more →


Settlement batches don’t know about daylight saving time

结算批次不知道夏令时

文章分享了一个因夏令时导致结算系统故障的案例,强调了在处理时间相关逻辑时考虑时区变化的必要性。

Read more →


Your pull request review time is mostly waiting and rework

你的 PR 审查时间大部分花在等待和返工上

文章分析了代码审查的成本结构,指出 AI 辅助审查虽然能提升速度,但真正的瓶颈在于团队协作流程。

Read more →


AI code review that follows your team’s rules: what each tool actually ingests

遵循团队规则的 AI 代码审查:工具实际摄入的内容

文章探讨了 AI 代码审查工具如何遵循团队编码标准,并分析了不同实现机制的

生成二维码中...
↗

请点击右上角 ···

选择 发送给朋友 或 收藏