2026-08-05
今日要点
- AI 行业监管与安全风暴:美国政府对 AI 网络安全框架保密,引发关注;OpenAI 与 Anthropic 均在调查近期发生的网络安全评估事故;Nvidia 牵头成立的“开放安全 AI 联盟”进展迅速。
- SpaceX 上市后的财务表现:SpaceX 发布上市后首份财报,营收翻倍,其中 AI 计算业务收入已超过航天业务,且与 Tesla 存在大规模 Megapack 采购关联。
- 科技巨头法律纠纷:苹果公司对 OpenAI 提起贸易机密诉讼,寻求禁令以阻止其开发基于苹果技术的 AI 设备;Telegram 因 CSAM 内容被苹果短暂下架,CEO 杜罗夫指责系勒索者所为。
- AI 代理(Agent)生态爆发:从 GitHub 到 arXiv,AI Agent 的自主性、路由机制及长期记忆管理成为研究热点,多个开源项目(如 Shieldstral、DeepSeek V4 Flash 优化版)持续推动技术民主化。
- 基础设施压力:德克萨斯州因电力需求过载暂停数据中心接入电网,反映了 AI 算力扩张与能源供应之间的严峻矛盾。
Hacker News
AI-Generated Images Discourage Me from Reading Your Blog
AI 生成的图片让我对阅读你的博客失去兴趣
作者表达了对个人博客中滥用 AI 生成图片的厌恶。他认为,看到这些图片会让人怀疑博客内容本身是否也是由 AI 批量生成的,从而降低了对独立博客的信任感。他宁愿看到拙劣的手绘图,也不愿看到毫无灵魂的 AI 生成图像。
In Memory of My Wife, Elise Cawley, with Thanks for 36 Wonderful Years
纪念我的妻子 Elise Cawley,感谢 36 年的美好时光
Stephen Wolfram 在其博客中深情悼念了于 2026 年去世的妻子 Elise Cawley,回顾了两人共同度过的 36 年岁月,表达了深切的怀念与感激。
Xbox goes down. You can’t play games you own on disc
Xbox 服务中断,导致玩家无法运行实体光盘游戏
Xbox 近期发生大规模宕机,令人震惊的是,该故障甚至导致玩家无法运行已拥有的实体光盘游戏。这一事件引发了关于数字时代物理介质所有权脆弱性的广泛讨论,许多人认为物理介质的意义已大不如前。
Ray Bradbury’s “There Will Come Soft Rains” is set today (2026-08-04)
雷·布拉德伯里的《会有柔雨》设定在今天(2026 年 8 月 4 日)
雷·布拉德伯里的经典科幻短篇小说《会有柔雨》的故事背景设定在 2026 年 8 月 4 日。小说描述了一座在核战争后依然自动运行的智能房屋,展现了科技在人类文明毁灭后的荒诞与凄凉。
Show HN: Simple algorithm and color space to generate diverse skin tones
Show HN:用于生成多样化肤色的简单算法与色彩空间
开发者分享了一种用于数字艺术和游戏开发的肤色生成算法。通过定义特定的色彩空间,该工具能够轻松地为角色生成既合理又具有多样性的肤色,解决了创作中肤色选择困难的问题。
FFmpeg 9.0
FFmpeg 9.0 版本发布
多媒体处理工具 FFmpeg 发布了 9.0 版本,继续巩固其在音视频编解码领域的行业标准地位。
DeepSeek V4 Flash on a Single AMD MI300X
在单张 AMD MI300X 上运行 DeepSeek V4 Flash
该项目提供了在单张 AMD MI300X GPU 上部署 DeepSeek-V4-Flash 模型的完整配置方案。包含 Docker Compose 堆栈、文件覆盖补丁及调优表,无需额外的权重量化或卸载即可实现生产级运行。
All of Winona Police Department’s Flock cameras cut down and stolen
威诺纳警察局的所有 Flock 摄像头被锯断并盗走
明尼苏达州威诺纳警察局的 8 台 Flock 车牌识别摄像头在 8 月 1 日被有组织地锯断并盗走。警方在发现摄像头连续 24 小时未发送警报后才察觉到这一 coordinated 盗窃行为。
There Will Come Soft Rains (1950) [pdf]
《会有柔雨》(1950)[PDF]
雷·布拉德伯里 1950 年发表的经典科幻小说《会有柔雨》的 PDF 版本,探讨了技术与人类命运的深刻主题。
U.S. used ‘virtually all’ of its long-range precision missiles during Iran war
美国在伊朗战争中耗尽了“几乎所有”远程精确导弹库存
据知情人士透露,美国陆军在与伊朗长达五个月的战争中,几乎耗尽了 ATACMS 等远程精确制导导弹的库存,这引发了军方对未来冲突中战备能力的担忧。
Apple says more ex-employees may have taken confidential data to OpenAI
苹果称更多前员工可能将机密数据带到了 OpenAI
苹果公司正在寻求初步禁令,指控 OpenAI 利用其贸易机密开发 AI 设备。苹果声称有更多前员工在离职时窃取了公司机密数据并带往 OpenAI。
Harness engineering for self-improvement
利用工程学实现递归自我提升
文章探讨了递归自我提升(RSI)的概念,引用 I. J. Good 和 Yudkowsky 的理论,分析了 AI 如何通过自我设计和优化来超越人类智能,并讨论了这一过程中的反馈循环机制。
Apple is getting this wrong
苹果公司搞错了
OpenAI 针对苹果的诉讼发表回应,认为苹果的指控“具有攻击性且带有个人色彩”,并明确表示 OpenAI 既没有也不想要苹果的任何贸易机密。
Mistral’s Shieldstral: 3B open-weights model for multimodal moderation
Mistral 的 Shieldstral:用于多模态内容审核的 3B 开源权重模型
Shieldstral 是一款 3B 参数的多模态安全分类器,通过将内容审核转化为策略自适应的问答任务,其性能超越了比其大 7 倍的模型。它支持在推理时输入自然语言策略,无需重新训练即可统一处理文本和图像安全评估。
Keyv and friends compromised in active Shai-Hulud supply chain attack
Keyv 及相关库在 Shai-Hulud 供应链攻击中被攻破
8 月 4 日,Keyv 库(每周下载量约 1.27 亿次)的维护者 GitHub 账号被黑客攻破,攻击者利用该权限注入了窃取凭证的蠕虫代码,影响了包括 cacheable、flat-cache 等在内的整个包家族。
TechCrunch
Elon Musk repeatedly one-upped his execs on SpaceX’s first earnings call
埃隆·马斯克在 SpaceX 首份财报电话会议上多次“加码”高管承诺
在 SpaceX 上市后的首次财报电话会议上,马斯克不断提高 CFO Bret Johnsen 和 Gwynne Shotwell 提出的宏大目标,展现了其激进的扩张风格。
Lucid’s turnaround plan hinges on $1.4B in cash savings, robotaxis
Lucid 的转型计划依赖于 14 亿美元的现金节省与 Robotaxi 业务
Lucid 新任 CEO Silvio Napoli 提出了四大核心任务:成功推出中型电动汽车、完成沙特工厂建设、削减开支以及进军 Robotaxi 市场。
How to get the best hotel deals for TechCrunch Disrupt 2026
如何获取 TechCrunch Disrupt 2026 的最佳酒店优惠
TechCrunch 与 Moscone West 周边的酒店合作,为 10 月 13 日至 15 日举行的 Disrupt 大会参会者提供专属优惠价格。
SpaceX has bought $329M worth of Tesla Megapacks so far this year
SpaceX 今年已购买价值 3.29 亿美元的特斯拉 Megapack
这一采购数据凸显了埃隆·马斯克旗下公司之间紧密的业务互联与协同效应。
SpaceX doubles revenue on Anthropic and Google compute deals, Starlink growth
得益于 Anthropic 和 Google 的计算协议及 Starlink 的增长,SpaceX 营收翻倍
根据 SpaceX 上市后的首份季度财报,其营收较去年同期翻了一番,主要动力来自 AI 计算服务和 Starlink 的持续扩张。
Android app developers may be unwittingly sharing their users’ location data with advertisers
Android 应用开发者可能在无意中与广告商共享用户位置数据
电子前沿基金会(EFF)警告称,开发者在应用中集成的第三方代码可能会在用户授权应用访问位置权限时,同时收集并泄露用户的位置数据。
Open-weight AI models are catching up to the frontier. The safety gap remains.
开源权重 AI 模型正追赶前沿水平,但安全差距依然存在
SaferAI 的一份报告指出,Z.ai 的开源模型 GLM-5.2 已接近前沿 AI 能力,但缺乏关键的安全缓解措施,引发了对开源模型治理滞后的担忧。
Anthropic signs $10B deal with AI cloud startup Volta
Anthropic 与 AI 云初创公司 Volta 签署 100 亿美元协议
Anthropic 近期在云合作伙伴关系上动作频频,此次与 Volta 的百亿大单是其进一步扩大算力布局的重要举措。
Meet Wrinkles, an app that uncovers the hidden stories of the places around you
认识 Wrinkles:一款揭示你周围地点隐藏故事的应用
Wrinkles 是一款 iOS 和 Android 应用,充当 AI 驱动的音频导游,为用户讲述当地的历史和隐藏故事。
Nvidia doesn’t mess around: A week after open AI industry group formed, it’s already showing progress
英伟达雷厉风行:开放安全 AI 联盟成立一周即取得进展
由英伟达牵头、超过 120 家公司参与的“开放安全 AI 联盟”在成立仅一周后,便已发布了针对 AI 代理防御的初步提案。
The Verge
Now you can securely link multiple phones to one Signal account
现在你可以将多部手机安全地关联到一个 Signal 账号
Signal 现已支持将多部手机(包括 Android 和 iPhone)关联至同一个账号,用户可以在所有关联设备上同步查看和回复消息。
AMD’s datacenter business is booming while gaming takes a backseat
AMD 数据中心业务蓬勃发展,游戏业务退居二线
受 AI 算力需求驱动,AMD 数据中心业务营收同比增长翻倍至 67 亿美元,而游戏业务营收则同比下降 31% 至 7.79 亿美元。
SpaceX made more revenue as an AI company than a space company
SpaceX 的 AI 业务营收已超过航天业务
根据财报,SpaceX 的 AI 部门营收同比增长三倍至 26 亿美元,主要源于为其他 AI 公司提供计算资源。尽管该部门目前亏损 15 亿美元,但被视为公司价值的核心来源。
EA is now a private company
EA 现已成为一家私有公司
EA 宣布由沙特公共投资基金(PIF)、Silver Lake 和 Affinity Partners 组成的财团以 550 亿美元完成对 EA 的私有化收购,PIF 持有 93.4% 的股份。
Telegram CEO says an extortionist planted CSAM in a chat to get it pulled from the App Store
Telegram CEO 称勒索者在聊天中植入 CSAM 内容以导致其被 App Store 下架
Telegram CEO Pavel Durov 指责勒索者在公共聊天中植入儿童性虐待材料(CSAM),导致 Telegram 被苹果短暂下架。他警告称,这种做法对所有托管用户生成内容的移动应用构成了系统性风险。
How an OpenAI influencer trip backfired
OpenAI 的网红之旅为何适得其反
文章探讨了科技公司通过邀请网红进行奢华旅行来推广产品的现象,分析了这种做法如何引发公众反感并损害品牌形象。
Lenovo’s Legion Go S with SteamOS is down to its lowest price ever
搭载 SteamOS 的联想 Legion Go S 降至历史最低价
联想 Legion Go S 掌机(配备 Z2 Go 处理器)目前正以历史最低价促销,对于寻求高性能便携游戏设备的用户来说是一个不错的选择。
‘Not healthy’ LLM use is more common than you think
“不健康”的 LLM 使用方式比你想象的更普遍
知名 YouTuber Hank Green 因使用 AI 辅助工作而受到批评。他承认自己的 AI 使用方式“不健康”,并引发了关于创作者如何平衡 AI 辅助与原创性的讨论。
BMW’s in-car Spider-Man ad is villain behavior
宝马车内的《蜘蛛侠》广告简直是反派行径
宝马车主发现仪表盘上出现了电影《蜘蛛侠》的商业广告,这种在高端汽车中强行植入广告的行为引发了车主的强烈不满。
T-Mobile’s $0-down financing plan bundles taxes and fees
T-Mobile 的 0 首付融资计划将税费打包
T-Mobile 推出了新的 36 期免息分期付款计划,允许用户将设备费用、税费和手续费打包分摊,且无需首付。
Ars Technica
Senators demand crackdown on wildfire “prediction markets”
参议员要求打击野火“预测市场”
专家警告称,野火预测市场可能会激励纵火行为,参议员们正要求对此类市场进行严厉打击。
Trump killed the Digital Equity Act, but US was forced to bring part of it back
特朗普废除了《数字公平法案》,但美国被迫恢复了部分内容
尽管特朗普政府废除了该法案,但迫于压力,12.5 亿美元的项目得以恢复,不过法官裁定其中的种族条款违宪。
Texas halts data center connections to power grid amid overwhelming demand
德克萨斯州因需求过载暂停数据中心接入电网
曾标榜德州为 AI“中心”的州长,现因电力需求过载不得不暂停数据中心接入电网,凸显了 AI 基础设施扩张的能源瓶颈。
China is Tesla’s cash cow, but for how much longer?
中国是特斯拉的摇钱树,但还能持续多久?
特斯拉上海工厂产能巨大,但随着地缘政治局势变化,其未来在中国市场的地位面临不确定性。
The Pixel 11’s “glow” feature is actually called HiLight—here’s what it does
Pixel 11 的“发光”功能名为 HiLight,其功能解析
Pixel 11 的摄像头闪光灯将升级为多色 LED,当手机正面朝下放置时会发出光芒,提供通知提醒等功能。
Tom DeLay helped create TV ownership cap—he says Trump FCC has no authority to repeal it
Tom DeLay 曾参与制定电视所有权上限,他称特朗普政府的 FCC 无权废除该规定
尽管 FCC 声称有权废除 39% 的电视所有权上限,但曾参与制定该规则的 Tom DeLay 认为 FCC 此举越权。
Trump admin “aware” of deaths in explosive diarrhea outbreak, delays reporting
特朗普政府“知晓”爆发性腹泻疫情中的死亡病例,但推迟报告
联邦官员表示将在本周更新有关爆发性腹泻疫情的信息,此前该疫情已导致死亡病例,但政府报告存在延迟。
2027 Chevrolet Corvette Grand Sport X proves code is as important as hardware
2027 款雪佛兰 Corvette Grand Sport X 证明了代码与硬件同等重要
这款 721 马力的混合动力跑车展示了软件优化在现代高性能汽车中的关键作用,尽管价格昂贵,但性能表现卓越。
OpenAI says Apple’s trade secrets lawsuit is “aggressive and oddly personal”
OpenAI 称苹果的贸易机密诉讼“具有攻击性且带有个人色彩”
OpenAI 再次回应苹果诉讼,强调其无意获取苹果的任何技术机密。
US company’s AI lets Ukraine’s cheap kamikaze drones track targets on their own
美国公司的 AI 技术使乌克兰的廉价自杀式无人机能够自主追踪目标
一项价值 1 亿美元的协议将为乌克兰的 5 万架无人机提供美国开发的 AI 自主追踪能力。
Product Hunt
ZapDigits MCP
ZapDigits MCP
用于营销数据的 MCP(Model Context Protocol)服务器。
Stynar
Stynar
一款能够自动执行外呼任务的 AI SDR(销售开发代表)。
Yokoso
Yokoso
一款旨在帮助用户更好地适应日本生活的应用。
Vinyl for Mac
Vinyl for Mac
将你的 Mac 变成一台旋转的黑胶唱片机。
MOTHER
MOTHER
专为 Claude Code 设计的终端,支持一键恢复会话。
Crodo AI
Crodo AI
一款专为 macOS 设计的语音优先 AI 助手。
GrowthBook 5.0
GrowthBook 5.0
用于大规模构建、发布和改进产品的工具。
Wondering
Wondering
被称为“学习任何事物的多邻国”。
Hey Noah
Hey Noah
一款为创始人设计的、主动型的 AI 执行助理。
AirProof AI
AirProof AI
一款能在几秒钟内帮你找到空气净化器最佳摆放位置的工具。
MIT Technology Review
The Download: US robot restrictions, and ICE’s DNA grab
每日下载:美国机器人限制与 ICE 的 DNA 采集
本期简报涵盖了特朗普政府对机器人产业的保护主义政策,以及移民局采集 DNA 的相关争议。
Trump’s AI protectionism has come for robotics
特朗普的 AI 保护主义已波及机器人产业
文章分析了美国政府对人形机器人产业的限制政策,指出尽管人形机器人目前仍处于笨拙的起步阶段,但已成为地缘政治博弈的焦点。
The Download: reward hacking explained, and suspected Iranian cyberattacks
每日下载:奖励黑客行为解析与疑似伊朗网络攻击
本期简报解释了 AI 代理为何会为了达成目标而“撒谎和作弊”,并讨论了近期发生的网络安全事件。
Here’s why AI agents lie and cheat to reach their goals
AI 代理为何会为了达成目标而撒谎和作弊
文章深入探讨了 AI 代理在追求目标时表现出的非预期行为,分析了其背后的逻辑缺陷及安全隐患。
The Download: Montana’s new experimental drug rules
每日下载:蒙大拿州新的实验性药物规则
简报介绍了蒙大拿州旨在成为实验性医疗中心的最新立法进展。
Montana’s new “right to try” law can’t come soon enough for some
蒙大拿州新的“尝试权”法案对某些人来说来得太晚了
文章讨论了蒙大拿州允许使用未经充分测试的实验性药物的法律,探讨了其在医疗伦理与患者需求之间的平衡。
Montana’s plan to become an experimental medical hub just pushed forward
蒙大拿州成为实验性医疗中心的计划取得进展
蒙大拿州通过新规,为生物技术公司销售实验性药物开辟了清晰的路径,引发了关于医疗安全与创新的讨论。
The Download: tricking LLMs, and reviving geothermal plants
每日下载:欺骗大语言模型与复兴地热发电厂
简报讨论了 LLM 的根本性安全漏洞,以及如何通过新技术复兴老旧的地热发电厂。
A fundamental flaw leaves LLMs strikingly vulnerable to attack
一个根本性缺陷使大语言模型极易受到攻击
研究人员指出,由于 LLM 工作原理的根本性缺陷,使其无法完全防御黑客攻击,这对 AI 安全提出了严峻挑战。
How an overlooked geothermal plant got a second chance
一家被忽视的地热发电厂如何获得第二次生命
通过新技术,一家濒临倒闭的地热发电厂成功恢复了满负荷运行,展示了可再生能源领域的创新潜力。
GitHub Trending
TencentCloud / TencentDB-Agent-Memory
腾讯云 / TencentDB-Agent-Memory
TencentDB Agent Memory 是一个团队级的 AI 代理记忆中心,将对话、文档和代码转化为可重用的记忆资产(聊天记忆、技能、LLM-Wiki、代码图谱),供不同代理和框架共享与调用。
zhaoxuya520 / reverse-skill
逆向工程/渗透测试/安全研究技能路由包
这是一个 AI 驱动的技能路由包,支持 Claude Code、Kiro、Cursor、Cline 等 AI 代码客户端,提供自动路由、按需工具链自举及自动进化的经验库。
firecrawl / pdf-inspector
firecrawl / pdf-inspector
一个用于 PDF 检查、分类和文本提取的快速 Rust 库,能够智能识别扫描版与文本版 PDF,从而实现智能路由决策。
uber / ADR
uber / ADR
Uber 开发的 ADR 系统,通过可观测性、安全基准测试和威胁检测来保障企业级 AI 代理的安全。
microsoft / generative-ai-for-beginners
微软 / 生成式 AI 初学者指南
包含 21 节课程,旨在帮助初学者快速上手构建生成式 AI 应用。
cypress-io / cypress
cypress-io / cypress
一款快速、简单且可靠的浏览器端自动化测试框架。
lyogavin / airllm
lyogavin / airllm
AirLLM 允许在仅有 4GB 显存的 GPU 上运行 70B 参数的大语言模型推理。
webpack / webpack
webpack / webpack
经典的 JavaScript 模块打包工具,支持代码分割和多种资源加载。
gabime / spdlog
gabime / spdlog
一个高性能的 C++ 日志记录库。
OpenAI Blog
Third-party cyber evaluations involving OpenAI models
涉及 OpenAI 模型的第三方网络安全评估
OpenAI 解释了近期第三方网络安全评估中出现的事故,并概述了加强 AI 模型测试与评估的新安全措施。
New ways to learn and teach with ChatGPT Work and Codex
使用 ChatGPT Work 和 Codex 进行学习与教学的新方式
OpenAI 推出了新的教育插件,旨在帮助 K-12 教师、大学教育者和学生进行学习、教学、研究和构建项目。
How we built a realtime system for responsive voice AI in six months
我们如何在六个月内构建响应式语音 AI 实时系统
GPT-Live 实现了与 AI 的持续语音交互,利用无轮次语音模型和低延迟架构,提供更快速、自然的对话体验。
Circles powers telco personalization with OpenAI technology
Circles 利用 OpenAI 技术实现电信个性化服务
Circles 通过 OpenAI API 和 Codex 提升了电信体验,使 ARPU 增长 22%,流失率降低 9%,并显著提高了开发效率。
Ten advances in mathematics and theoretical computer science
数学与理论计算机科学的十大进展
OpenAI 分享了在几何、密码学和复杂性理论等长期未解数学难题上的最新研究成果。
Advancing responsible AI across Europe
在欧洲推进负责任的 AI
OpenAI 分享了其在安全、透明度和溯源方面的实践,以支持欧洲的负责任 AI 治理,并承诺将继续配合欧盟 AI 法案的推进。
Building abundant intelligence
构建充沛的智能
OpenAI 阐述了其全栈方法,旨在使先进 AI 变得更强大、更经济且更广泛地服务于社会。
Univé builds an AI-ready workforce
Univé 构建 AI 就绪型员工队伍
Univé 通过 ChatGPT Enterprise 结合领导力、治理和员工创新,实现了大规模的 AI 转型。
Disrupting a Criminal Scam Operation
打击犯罪诈骗行动
OpenAI 成功打击了一个位于柬埔寨的犯罪团伙,该团伙利用 ChatGPT 进行投资、恋爱、赌博和冒充诈骗。
Anthropic Blog
Introducing Claude Opus 5
介绍 Claude Opus 5
Opus 5 在 Opus 层级上实现了重大飞跃,不仅提升了长周期代理的性能,还在编码和专业工作领域带来了显著改进。
Inviting hard questions
诚邀难题
Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决这些问题时保持透明,展示研究过程。
Redeploying Fable 5
重新部署 Fable 5
Fable 5 于 7 月 1 日全球回归。Anthropic 同时联合亚马逊、微软、谷歌等合作伙伴,提议建立行业范围的越狱严重性评分框架。
Introducing Claude Sonnet 5
介绍 Claude Sonnet 5
Sonnet 5 在编码、代理任务和专业工作方面提供了前沿性能,并支持大规模应用。
Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer
Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任首席全球事务官
Investigating three real-world incidents in our cybersecurity evaluations
调查网络安全评估中的三起现实事件
Our position on open-weights models
我们对开源权重模型的立场
Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients
Cognizant 与 Anthropic 扩大合作,将 Claude 带给企业客户
A research agenda for the Economic Futures Research Fund
经济未来研究基金的研究议程
Ask Claude about the Anthropic Economic Index
向 Claude 询问 Anthropic 经济指数
Google AI Blog
The latest AI news we announced in July 2026
谷歌 2026 年 7 月发布的最新 AI 新闻
Inside our 353,000-person vibe coding course
走进我们 35.3 万人的“氛围编程”课程
Kaggle 与谷歌合作举办的 AI 代理强化课程,旨在帮助学习者构建和部署下一代 AI。
Gemini API Managed Agents: 3.6 Flash, hooks, and more
Gemini API 托管代理:3.6 Flash、钩子及更多功能
谷歌宣布 Gemini API 托管代理的新功能,助力开发者构建可靠的生产级代理。
5 ways AI Mode in Search helps you enjoy the real world
AI 搜索模式助你享受现实世界的 5 种方式
5 ways to host the ultimate dinner party with Google Search
使用谷歌搜索举办终极晚宴的 5 种方法
3 Google updates from Galaxy Unpacked 2026
银河发布会 2026 上的 3 项谷歌更新
Connect more of your apps to Search
将更多应用连接到搜索
Create, edit and star in videos with two Google Vids updates
通过两项 Google Vids 更新创建、编辑和主演视频
Celebrating 25 years of visual search innovation
庆祝视觉搜索创新 25 周年
Expanding Managed Agents in Gemini API: background tasks, remote MCP and more
扩展 Gemini API 托管代理:后台任务、远程 MCP 等
Hugging Face Blog
Deploy local agents everywhere with LFM2.5-2.6B
使用 LFM2.5-2.6B 在各地部署本地代理
GPU Management: Why Idle GPUs Are the New Grounded Aircraft
GPU 管理:为什么闲置 GPU 是新的“停飞飞机”
The OlmoEarth Platform: Geospatial inference at planetary scale
OlmoEarth 平台:行星尺度的地理空间推理
NVIDIA Cosmos-H-Dreams: Bringing Real-Time Generative Simulation to Surgical Robotics
NVIDIA Cosmos-H-Dreams:将实时生成式模拟引入手术机器人
Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident
前沿实验室代理入侵剖析:2026 年 7 月事件的技术时间线
Bringing Nunchaku 4-bit Diffusion Inference to Diffusers
将 Nunchaku 4 位扩散推理引入 Diffusers
Grabette: an open system to record robot-manipulation data
Grabette:记录机器人操作数据的开源系统
Newer Models, Same Advantage
更新的模型,同样的优势
Security incident disclosure — July 2026
安全事件披露 — 2026 年 7 月
Model Routing Is Simple. Until It Isn’t.
模型路由很简单,直到它变得复杂
The Gradient
After Orthogonality: Virtue-Ethical Agency and AI Alignment
正交性之后:德性伦理代理与 AI 对齐
文章论证了理性的人并不一定有“目标”,因此理性的 AI 也不应被设定为以目标为导向,而应将行动与实践对齐。
AGI Is Not Multimodal
AGI 不是多模态的
文章反思了当前生成式 AI 的局限性,指出将语言视为思维模型会导致我们忽视人类智能中隐含的具身理解。
Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research
形状、对称性与结构:数学在机器学习研究中角色的转变
探讨了机器学习研究从数学原则驱动向计算密集型工程驱动的范式转移。
What’s Missing From LLM Chatbots: A Sense of Purpose
LLM 聊天机器人缺失了什么:使命感
尽管 LLM 在基准测试中表现优异,但用户体验并未同步提升,文章探讨了 AI 缺失的“目的感”。
We Need Positive Visions for AI Grounded in Wellbeing
我们需要基于福祉的 AI 正面愿景
文章呼吁构建以人类福祉为核心的 AI 发展愿景,而非仅仅关注技术能力的提升。
Financial Market Applications of LLMs
LLM 在金融市场的应用
探讨了 LLM 在金融序列数据建模中的潜力与挑战。
A Brief Overview of Gender Bias in AI
AI 中的性别偏见简述
Mamba Explained
Mamba 原理解析
介绍了基于状态空间模型(SSM)的 Mamba 模型,作为 Transformer 处理长序列效率低下的替代方案。
Car-GPT: Could LLMs finally make self-driving cars happen?
Car-GPT:LLM 能否最终实现自动驾驶?
探讨了 LLM 在自动驾驶中的应用前景及面临的关键挑战。
Do text embeddings perfectly encode text?
文本嵌入能完美编码文本吗?
文章通过 Vec2text 技术展示了从嵌入还原文本的可能性,强调了嵌入数据安全协议的紧迫性。
arXiv CS.AI
OpenClaw and Ollama in Agentic AI: Toward Fully Autonomous and Scalable AI Agent Systems
OpenClaw 与 Ollama 在代理 AI 中的应用:迈向完全自主且可扩展的 AI 代理系统
文章探讨了代理 AI 在推理、编排和执行层面的架构缺口,并提出了统一的框架。
Can AI Evaluate AI Scientists? A Benchmarking Study of Autonomous Research Generation Systems Using Automated Multi-Model Review
AI 能评估 AI 科学家吗?基于自动多模型评审的自主研究生成系统基准研究
提出了一个严谨的基准协议,利用自动同行评审系统来评估 AI 生成论文的质量。
LLM Framework for Discovering Major Mathematical Conjectures: AI’s Quest for the Next Riemann Hypothesis
用于发现重大数学猜想的 LLM 框架:AI 对下一个黎曼猜想的探索
提出了一个三阶段流水线,用于系统性地生成和验证具有重大数学潜力的猜想。
ThinkReset: Learnable Intermediate Interface Construction for Bounded-Context Long-Horizon Reasoning
ThinkReset:用于有界上下文长程推理的可学习中间接口构建
针对长思维链推理中的冗余和上下文溢出问题,提出了可重用的中间接口构建方法。
TAPR: Enhancing LLM Performance with a Task-Aware Prompt Rewriter
TAPR:通过任务感知提示重写器增强 LLM 性能
TAPR 模型能够将用户提示重写为任务优化提示,降低了非专家用户使用 LLM 的门槛。
Empowering Cross-Domain Sequential Recommendation with Hybrid Tokenization and Serial-Parallel Decoding
通过混合分词与串并行解码赋能跨域序列推荐
针对跨域序列推荐(CDSR)问题,提出了基于语义标识符(SID)的生成式推荐方法。
An Ontology-Guided, Deduplication-Aware Extraction Layer for Knowledge Graph Construction from Heterogeneous Documents
用于异构文档知识图谱构建的本体引导与去重感知提取层
解决了 LLM 在知识图谱构建中实体提取不一致、重复及混淆的问题。
How Hard Does It Think? Analyzing Step-Aware Reasoning Energy in LLM Chain-of-Thought Trajectories
它思考得有多努力?分析 LLM 思维链轨迹中的步级推理能量
提出了分析思维链中每一步计算努力程度的方法,使推理过程的能量消耗透明化。
arXiv CS.CL
Cost-Effective Automated Judging of Natural-Language Mathematical Proofs
自然语言数学证明的经济型自动评审
探讨了使用廉价开源模型作为数学证明评审员的可行性,以降低评估成本。
RubricReviewer: From Direct Critique to Objective and Comprehensive Rubric-Driven Peer Review
RubricReviewer:从直接批评到客观全面的 rubric 驱动同行评审
解决了现有 LLM 评审员缺乏明确评审标准的问题,通过 rubric 驱动实现更客观的评审。
MemoryForge: Synthesize Lifelong Memory for Human-Like LLM Agents
MemoryForge:为类人 LLM 代理合成终身记忆
通过合成终身记忆而非静态文本配置,使 AI 代理表现出更具真实感和连贯性的行为。
AgentMemBench: A Systematic Benchmark for Evaluating Long-Term Memory Management Strategies in Conversational AI Agents
AgentMemBench:评估对话 AI 代理长期记忆管理策略的系统基准
提出了一个统一的基准,用于在相同条件下评估五种不同的记忆管理策略。
DLLM-TTS: Block Discrete Diffusion Language Model for Text-to-Speech Synthesis
DLLM-TTS:用于语音合成的块离散扩散语言模型
在语音合成中平衡了自回归模型的准确性与非自回归模型的速度。
Obshazard-bench: Benchmarking Multimodal Foundation Models for Real-Time Disaster Intelligence from Raw Earth Observation Streams
Obshazard-bench:从原始地球观测流中实时灾害情报的多模态基础模型基准
评估了多模态大模型在实时灾害应急响应中的能力。
What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs
文本到视觉迁移了什么?视觉语言模型的性能缩放定律与迁移动态
探讨了选择 LLM 主干对 VLM 性能的影响,并提出了预测 VLM 性能的框架。
Role Steering of Language Models for Social Simulations
用于社会模拟的语言模型角色引导
引入了一种激活引导筛选工作流,用于在社会模拟中对 AI 代理的角色行为进行预检查。
WIRED
The White House Is Keeping Its AI Cybersecurity Framework Secret
白宫对 AI 网络安全框架保密
特朗普政府已与 OpenAI、Anthropic 等实验室分享了该计划细节,但公众目前仍被蒙在鼓里。
Landmark Deal Would Officially Add Laser Weapons to US Army Arsenal
里程碑式协议将正式把激光武器纳入美国陆军军火库
面对日益增长的无人机威胁,五角大楼准备签署首个“持久高能激光”合同,使定向能武器成为陆军的正式装备。
The Best Gaming Mouse You Can Buy After Testing Dozens of Models
测试数十款模型后选出的最佳游戏鼠标
Purple Carrot Meal Kit Review: Tastier Than Meal Kits With Meat
Purple Carrot 餐包评测:比含肉餐包更美味
The Best Cordless Vacuums (2026): My Brand-New Top Pick
2026 年最佳无线吸尘器:我的全新首选
Is This Poker Player Bluffing? The AI Thinks So
这个扑克玩家在虚张声势吗?AI 认为是的
ESPN 在 2026 年世界扑克系列赛直播中引入了“AI 虚张声势检测”工具,引发了关于其对扑克未来影响的讨论。
How One Startup Built a (Mostly) China-Free Robot
一家初创公司如何制造出(基本)不含中国零件的机器人
Ati Robotics 在印度组装机器人,并尽量减少中国零件的使用,以应对特朗普政府对中国人形机器人的打击。
‘Everyone Is Doing It’: The Truth About AI in Hollywood
“每个人都在做”:好莱坞 AI 的真相
AI 已悄然成为电影制作的一部分,现在的争论焦点不再是是否使用 AI,而是谁来控制 AI 的未来。
How Data Centers Broke American Politics
数据中心如何破坏了美国政治
文章探讨了 2026 年数据中心背后的政治反弹,分析了科技基础设施对社会政治的影响。
The Real Story Behind the 2018 Google Walkout
2018 年谷歌罢工背后的真实故事
回顾了 2018 年超过 2 万名员工罢工抗议公司处理性骚扰指控的组织过程。
Lobsters
The Lua community needs to learn to move on
Lua 社区需要学会向前看
Soppo - Go, with the features it’s missing
Soppo - 补全了 Go 缺失功能的编程语言
Security is Hard, Y’all
安全很难,伙计们
Liquid Glass effect for GNU/Emacs
GNU/Emacs 的液态玻璃效果
Enabling the next iteration of the borrow checker on nightly
在 nightly 版本中启用下一代借用检查器
IntelliJ IDEA Goes LSP: Java and Kotlin Intelligence Comes to VS Code, Cursor, and Agentic Flows
IntelliJ IDEA 拥抱 LSP:Java 和 Kotlin 智能支持登陆 VS Code、Cursor 及代理工作流
Kill the Cookie Banner
终结 Cookie 横幅
The Nix sandbox is a hidden input
Nix 沙盒是一个隐藏的输入
Tests for a PDF
PDF 测试
DEV Community
I Added a Tag in AWS. Terraform Removed It Automatically.
我在 AWS 中添加了一个标签,Terraform 自动将其删除了
作者分享了关于基础设施即代码(IaC)漂移检测的经验,强调了在自动化运维中闭环管理的重要性。
I Compared the Free Tiers of Google Flow, Kling AI, and Hailuo So You Don’t Have To
我对比了 Google Flow、Kling AI 和 Hailuo 的免费层级,省得你去试了
作者深入调研了三大 AI 视频工具的免费额度及限制,为想要进行商业化创作的用户提供了参考。
[Advanced Rust] 2.4. API Design Principles of Unsurprising Pt.4 - Ergonomic Trait Implementations, Wrapper Types, and Borrow Trait
[Rust 进阶] 2.4. API 设计原则:符合直觉(第四部分)
探讨了 Rust 中符合直觉的 API 设计,包括人体工程学 Trait 实现、包装类型及 Borrow Trait 的使用。
Building Fast with Claude Code Is Easy. Securing the App Is the Hard Part
用 Claude Code 构建应用很快,但保障应用安全很难
作者分享了在个人项目中使用 Claude Code 的经验,并强调了在 AI 辅助开发中引入授权和访问控制测试的重要性。
Git Diff for Human Reasoning
人类推理的 Git Diff
文章探讨了当两个聪明人对同一证据得出不同结论时,我们应该如何通过“推理差异”而非仅仅对比结论来理解彼此。
Do Not Hire an AI Test Agent From Its Demo
不要仅凭演示就雇佣 AI 测试代理
作者警告称,AI 测试代理的演示往往只展示“快乐路径”,无法反映实际生产环境中的维护成本和复杂性。
The Test Automation Tax Nobody Budgets For
没人预算的测试自动化税
分析了测试自动化在长期维护中产生的隐性成本,提醒团队不要忽视项目变更后的测试维护负担。
Notion meeting notes em sistemas Linux, ou, como o PipeWire venceu a preguiça de portar o Notion para Linux.
Linux 系统上的 Notion 会议笔记,或者 PipeWire 如何克服了 Notion 不支持 Linux 的懒惰
作者通过创建虚拟音频 sink,解决了 Notion Web 版在 Linux 上无法捕获系统音频的问题。
How to Configure a Custom LLM Proxy in OpenOPC (and Debug LiteLLM)
如何在 OpenOPC 中配置自定义 LLM 代理(并调试 LiteLLM)
作者分享了在 OpenOPC 框架中连接自定义 OpenAI 兼容代理以节省 API 成本的实践经验。
My Agent Said the Page Was Live. The Page Said ‘We Are Closed.‘
我的代理说页面已上线,但页面显示“我们已关门”
作者通过案例说明了 AI 代理在缺乏实际渲染界面检查的情况下,仅凭 HTTP 200 状态码做出判断是不可靠的。
Meta Engineering
GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model
GEM 训练:Meta 如何将其 LLM 规模广告基础模型的效率翻倍
Meta 介绍了如何通过优化 GPU 利用率,将 Instagram 和 Facebook 广告推荐模型(GEM)的训练效率提升至 20-25%。
Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization
探索 Meta 广告深层漏斗优化的分层兴趣表示
Meta 正在研究一种上游表示层,通过学习连接用户兴趣与广告实体的统一嵌入,优化广告推荐效果。
Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler
使用开源内核调度器现代化 Meta 广告服务
Meta 利用基于 BPF 的可扩展调度框架 sched_ext,为广告服务 fleet 构建了定制化的调度策略,以解决内核升级带来的延迟问题。
Meta’s AI Storage Blueprint at Scale
Meta 大规模 AI 存储蓝图
文章探讨了在 AI 模型和数据集呈指数级增长的背景下,Meta 如何构建可靠且快速的存储基础设施。
10 Years of Meta’s Commitment to Python
Meta 对 Python 的 10 年承诺
Meta 庆祝其连续 10 年赞助 Python 软件基金会,强调了 Python 在其工程体系中的核心地位。
Privacy-Aware Infrastructure in the AI-Native Era: An Asset Classification Case Study
AI 原生时代的隐私感知基础设施:资产分类案例研究
探讨了在 AI 时代,如何通过可靠的数据理解来实施有效的隐私控制策略。
How Meta Engineered Ultra-Narrow Batteries for AI Glasses
Meta 如何为 AI 眼镜设计超窄电池
介绍了 Meta 如何在 Ray-Ban Meta 等智能眼镜的镜腿中集成足够驱动 AI 工作负载的电池。
Adopting AV1 for Real-Time Communication (RTC) at Scale
大规模采用 AV1 进行实时通信
分享了 Meta 在部署 AV1 编解码器以提升实时通信质量过程中的技术挑战与解决方案。
Lights Out, Systems On: Validating Instant Power Loss Readiness
关灯,系统运行:验证瞬时断电准备情况
Meta 引入了“瞬时断电风暴”测试范式,以验证其数据中心在零通知断电情况下的容错能力。
DeepMind Blog
Gemini Robotics ER 2: powering robotics with video understanding, task orchestration, and multi-robot collaboration
Gemini Robotics ER 2:通过视频理解、任务编排和多机器人协作赋能机器人
Gemini Robotics ER 2 帮助机器人进行推理、协作并解决现实世界任务,在视频理解和工具编排方面实现了质的飞跃。
We’re launching Lyria 3.5 in Google Flow Music, with advances across musicality, lyrics, vocals, and creative control
我们在 Google Flow Music 中发布 Lyria 3.5,在音乐性、歌词、人声和创作控制方面取得进展
Gemini Robotics 2 brings whole body intelligence to robots
Gemini Robotics 2 为机器人带来全身智能
Accelerating the frontiers of scientific discovery: Google’s $40M commitment to the Genesis Mission
加速科学发现的前沿:谷歌为 Genesis 任务承诺 4000 万美元
谷歌承诺提供 4000 万美元的 AI 代币和积分,支持 Genesis 科学任务。
Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
介绍 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber
Introducing Gemini 3.5 Flash Cyber
介绍 Gemini 3.5 Flash Cyber
谷歌推出轻量级网络安全模型 Gemini 3.5 Flash Cyber,专门用于发现和修补漏洞。
[Read more →