2026-08-05

今日要点


Hacker News

AI-Generated Images Discourage Me from Reading Your Blog

AI 生成的图片让我对阅读你的博客失去兴趣

作者表达了对个人博客中滥用 AI 生成图片的厌恶。他认为,看到这些图片会让人怀疑博客内容本身是否也是由 AI 批量生成的,从而降低了对独立博客的信任感。他宁愿看到拙劣的手绘图,也不愿看到毫无灵魂的 AI 生成图像。

Read more →


In Memory of My Wife, Elise Cawley, with Thanks for 36 Wonderful Years

纪念我的妻子 Elise Cawley,感谢 36 年的美好时光

Stephen Wolfram 在其博客中深情悼念了于 2026 年去世的妻子 Elise Cawley,回顾了两人共同度过的 36 年岁月,表达了深切的怀念与感激。

Read more →


Xbox goes down. You can’t play games you own on disc

Xbox 服务中断,导致玩家无法运行实体光盘游戏

Xbox 近期发生大规模宕机,令人震惊的是,该故障甚至导致玩家无法运行已拥有的实体光盘游戏。这一事件引发了关于数字时代物理介质所有权脆弱性的广泛讨论,许多人认为物理介质的意义已大不如前。

Read more →


Ray Bradbury’s “There Will Come Soft Rains” is set today (2026-08-04)

雷·布拉德伯里的《会有柔雨》设定在今天(2026 年 8 月 4 日)

雷·布拉德伯里的经典科幻短篇小说《会有柔雨》的故事背景设定在 2026 年 8 月 4 日。小说描述了一座在核战争后依然自动运行的智能房屋,展现了科技在人类文明毁灭后的荒诞与凄凉。

Read more →


Show HN: Simple algorithm and color space to generate diverse skin tones

Show HN:用于生成多样化肤色的简单算法与色彩空间

开发者分享了一种用于数字艺术和游戏开发的肤色生成算法。通过定义特定的色彩空间,该工具能够轻松地为角色生成既合理又具有多样性的肤色,解决了创作中肤色选择困难的问题。

Read more →


FFmpeg 9.0

FFmpeg 9.0 版本发布

多媒体处理工具 FFmpeg 发布了 9.0 版本,继续巩固其在音视频编解码领域的行业标准地位。

Read more →


DeepSeek V4 Flash on a Single AMD MI300X

在单张 AMD MI300X 上运行 DeepSeek V4 Flash

该项目提供了在单张 AMD MI300X GPU 上部署 DeepSeek-V4-Flash 模型的完整配置方案。包含 Docker Compose 堆栈、文件覆盖补丁及调优表,无需额外的权重量化或卸载即可实现生产级运行。

Read more →


All of Winona Police Department’s Flock cameras cut down and stolen

威诺纳警察局的所有 Flock 摄像头被锯断并盗走

明尼苏达州威诺纳警察局的 8 台 Flock 车牌识别摄像头在 8 月 1 日被有组织地锯断并盗走。警方在发现摄像头连续 24 小时未发送警报后才察觉到这一 coordinated 盗窃行为。

Read more →


There Will Come Soft Rains (1950) [pdf]

《会有柔雨》(1950)[PDF]

雷·布拉德伯里 1950 年发表的经典科幻小说《会有柔雨》的 PDF 版本,探讨了技术与人类命运的深刻主题。

Read more →


U.S. used ‘virtually all’ of its long-range precision missiles during Iran war

美国在伊朗战争中耗尽了“几乎所有”远程精确导弹库存

据知情人士透露,美国陆军在与伊朗长达五个月的战争中,几乎耗尽了 ATACMS 等远程精确制导导弹的库存,这引发了军方对未来冲突中战备能力的担忧。

Read more →


Apple says more ex-employees may have taken confidential data to OpenAI

苹果称更多前员工可能将机密数据带到了 OpenAI

苹果公司正在寻求初步禁令,指控 OpenAI 利用其贸易机密开发 AI 设备。苹果声称有更多前员工在离职时窃取了公司机密数据并带往 OpenAI。

Read more →


Harness engineering for self-improvement

利用工程学实现递归自我提升

文章探讨了递归自我提升(RSI)的概念,引用 I. J. Good 和 Yudkowsky 的理论,分析了 AI 如何通过自我设计和优化来超越人类智能,并讨论了这一过程中的反馈循环机制。

Read more →


Apple is getting this wrong

苹果公司搞错了

OpenAI 针对苹果的诉讼发表回应,认为苹果的指控“具有攻击性且带有个人色彩”,并明确表示 OpenAI 既没有也不想要苹果的任何贸易机密。

Read more →


Mistral’s Shieldstral: 3B open-weights model for multimodal moderation

Mistral 的 Shieldstral:用于多模态内容审核的 3B 开源权重模型

Shieldstral 是一款 3B 参数的多模态安全分类器,通过将内容审核转化为策略自适应的问答任务,其性能超越了比其大 7 倍的模型。它支持在推理时输入自然语言策略,无需重新训练即可统一处理文本和图像安全评估。

Read more →


Keyv and friends compromised in active Shai-Hulud supply chain attack

Keyv 及相关库在 Shai-Hulud 供应链攻击中被攻破

8 月 4 日,Keyv 库(每周下载量约 1.27 亿次)的维护者 GitHub 账号被黑客攻破,攻击者利用该权限注入了窃取凭证的蠕虫代码,影响了包括 cacheable、flat-cache 等在内的整个包家族。

Read more →


TechCrunch

Elon Musk repeatedly one-upped his execs on SpaceX’s first earnings call

埃隆·马斯克在 SpaceX 首份财报电话会议上多次“加码”高管承诺

在 SpaceX 上市后的首次财报电话会议上,马斯克不断提高 CFO Bret Johnsen 和 Gwynne Shotwell 提出的宏大目标,展现了其激进的扩张风格。

Read more →


Lucid’s turnaround plan hinges on $1.4B in cash savings, robotaxis

Lucid 的转型计划依赖于 14 亿美元的现金节省与 Robotaxi 业务

Lucid 新任 CEO Silvio Napoli 提出了四大核心任务:成功推出中型电动汽车、完成沙特工厂建设、削减开支以及进军 Robotaxi 市场。

Read more →


How to get the best hotel deals for TechCrunch Disrupt 2026

如何获取 TechCrunch Disrupt 2026 的最佳酒店优惠

TechCrunch 与 Moscone West 周边的酒店合作,为 10 月 13 日至 15 日举行的 Disrupt 大会参会者提供专属优惠价格。

Read more →


SpaceX has bought $329M worth of Tesla Megapacks so far this year

SpaceX 今年已购买价值 3.29 亿美元的特斯拉 Megapack

这一采购数据凸显了埃隆·马斯克旗下公司之间紧密的业务互联与协同效应。

Read more →


根据 SpaceX 上市后的首份季度财报,其营收较去年同期翻了一番,主要动力来自 AI 计算服务和 Starlink 的持续扩张。

Read more →


Android app developers may be unwittingly sharing their users’ location data with advertisers

Android 应用开发者可能在无意中与广告商共享用户位置数据

电子前沿基金会(EFF)警告称,开发者在应用中集成的第三方代码可能会在用户授权应用访问位置权限时,同时收集并泄露用户的位置数据。

Read more →


Open-weight AI models are catching up to the frontier. The safety gap remains.

开源权重 AI 模型正追赶前沿水平,但安全差距依然存在

SaferAI 的一份报告指出,Z.ai 的开源模型 GLM-5.2 已接近前沿 AI 能力,但缺乏关键的安全缓解措施,引发了对开源模型治理滞后的担忧。

Read more →


Anthropic signs $10B deal with AI cloud startup Volta

Anthropic 与 AI 云初创公司 Volta 签署 100 亿美元协议

Anthropic 近期在云合作伙伴关系上动作频频,此次与 Volta 的百亿大单是其进一步扩大算力布局的重要举措。

Read more →


Meet Wrinkles, an app that uncovers the hidden stories of the places around you

认识 Wrinkles:一款揭示你周围地点隐藏故事的应用

Wrinkles 是一款 iOS 和 Android 应用,充当 AI 驱动的音频导游,为用户讲述当地的历史和隐藏故事。

Read more →


Nvidia doesn’t mess around: A week after open AI industry group formed, it’s already showing progress

英伟达雷厉风行:开放安全 AI 联盟成立一周即取得进展

由英伟达牵头、超过 120 家公司参与的“开放安全 AI 联盟”在成立仅一周后,便已发布了针对 AI 代理防御的初步提案。

Read more →


The Verge

现在你可以将多部手机安全地关联到一个 Signal 账号

Signal 现已支持将多部手机(包括 Android 和 iPhone)关联至同一个账号,用户可以在所有关联设备上同步查看和回复消息。

Read more →


AMD’s datacenter business is booming while gaming takes a backseat

AMD 数据中心业务蓬勃发展,游戏业务退居二线

受 AI 算力需求驱动,AMD 数据中心业务营收同比增长翻倍至 67 亿美元,而游戏业务营收则同比下降 31% 至 7.79 亿美元。

Read more →


SpaceX made more revenue as an AI company than a space company

SpaceX 的 AI 业务营收已超过航天业务

根据财报,SpaceX 的 AI 部门营收同比增长三倍至 26 亿美元,主要源于为其他 AI 公司提供计算资源。尽管该部门目前亏损 15 亿美元,但被视为公司价值的核心来源。

Read more →


EA is now a private company

EA 现已成为一家私有公司

EA 宣布由沙特公共投资基金(PIF)、Silver Lake 和 Affinity Partners 组成的财团以 550 亿美元完成对 EA 的私有化收购,PIF 持有 93.4% 的股份。

Read more →


Telegram CEO says an extortionist planted CSAM in a chat to get it pulled from the App Store

Telegram CEO 称勒索者在聊天中植入 CSAM 内容以导致其被 App Store 下架

Telegram CEO Pavel Durov 指责勒索者在公共聊天中植入儿童性虐待材料(CSAM),导致 Telegram 被苹果短暂下架。他警告称,这种做法对所有托管用户生成内容的移动应用构成了系统性风险。

Read more →


How an OpenAI influencer trip backfired

OpenAI 的网红之旅为何适得其反

文章探讨了科技公司通过邀请网红进行奢华旅行来推广产品的现象,分析了这种做法如何引发公众反感并损害品牌形象。

Read more →


Lenovo’s Legion Go S with SteamOS is down to its lowest price ever

搭载 SteamOS 的联想 Legion Go S 降至历史最低价

联想 Legion Go S 掌机(配备 Z2 Go 处理器)目前正以历史最低价促销,对于寻求高性能便携游戏设备的用户来说是一个不错的选择。

Read more →


‘Not healthy’ LLM use is more common than you think

“不健康”的 LLM 使用方式比你想象的更普遍

知名 YouTuber Hank Green 因使用 AI 辅助工作而受到批评。他承认自己的 AI 使用方式“不健康”,并引发了关于创作者如何平衡 AI 辅助与原创性的讨论。

Read more →


BMW’s in-car Spider-Man ad is villain behavior

宝马车内的《蜘蛛侠》广告简直是反派行径

宝马车主发现仪表盘上出现了电影《蜘蛛侠》的商业广告,这种在高端汽车中强行植入广告的行为引发了车主的强烈不满。

Read more →


T-Mobile’s $0-down financing plan bundles taxes and fees

T-Mobile 的 0 首付融资计划将税费打包

T-Mobile 推出了新的 36 期免息分期付款计划,允许用户将设备费用、税费和手续费打包分摊,且无需首付。

Read more →


Ars Technica

Senators demand crackdown on wildfire “prediction markets”

参议员要求打击野火“预测市场”

专家警告称,野火预测市场可能会激励纵火行为,参议员们正要求对此类市场进行严厉打击。

Read more →


Trump killed the Digital Equity Act, but US was forced to bring part of it back

特朗普废除了《数字公平法案》,但美国被迫恢复了部分内容

尽管特朗普政府废除了该法案,但迫于压力,12.5 亿美元的项目得以恢复,不过法官裁定其中的种族条款违宪。

Read more →


Texas halts data center connections to power grid amid overwhelming demand

德克萨斯州因需求过载暂停数据中心接入电网

曾标榜德州为 AI“中心”的州长,现因电力需求过载不得不暂停数据中心接入电网,凸显了 AI 基础设施扩张的能源瓶颈。

Read more →


China is Tesla’s cash cow, but for how much longer?

中国是特斯拉的摇钱树,但还能持续多久?

特斯拉上海工厂产能巨大,但随着地缘政治局势变化,其未来在中国市场的地位面临不确定性。

Read more →


The Pixel 11’s “glow” feature is actually called HiLight—here’s what it does

Pixel 11 的“发光”功能名为 HiLight,其功能解析

Pixel 11 的摄像头闪光灯将升级为多色 LED,当手机正面朝下放置时会发出光芒,提供通知提醒等功能。

Read more →


Tom DeLay helped create TV ownership cap—he says Trump FCC has no authority to repeal it

Tom DeLay 曾参与制定电视所有权上限,他称特朗普政府的 FCC 无权废除该规定

尽管 FCC 声称有权废除 39% 的电视所有权上限,但曾参与制定该规则的 Tom DeLay 认为 FCC 此举越权。

Read more →


Trump admin “aware” of deaths in explosive diarrhea outbreak, delays reporting

特朗普政府“知晓”爆发性腹泻疫情中的死亡病例,但推迟报告

联邦官员表示将在本周更新有关爆发性腹泻疫情的信息,此前该疫情已导致死亡病例,但政府报告存在延迟。

Read more →


2027 Chevrolet Corvette Grand Sport X proves code is as important as hardware

2027 款雪佛兰 Corvette Grand Sport X 证明了代码与硬件同等重要

这款 721 马力的混合动力跑车展示了软件优化在现代高性能汽车中的关键作用,尽管价格昂贵,但性能表现卓越。

Read more →


OpenAI says Apple’s trade secrets lawsuit is “aggressive and oddly personal”

OpenAI 称苹果的贸易机密诉讼“具有攻击性且带有个人色彩”

OpenAI 再次回应苹果诉讼,强调其无意获取苹果的任何技术机密。

Read more →


US company’s AI lets Ukraine’s cheap kamikaze drones track targets on their own

美国公司的 AI 技术使乌克兰的廉价自杀式无人机能够自主追踪目标

一项价值 1 亿美元的协议将为乌克兰的 5 万架无人机提供美国开发的 AI 自主追踪能力。

Read more →


Product Hunt

ZapDigits MCP

ZapDigits MCP

用于营销数据的 MCP(Model Context Protocol)服务器。

Read more →


Stynar

Stynar

一款能够自动执行外呼任务的 AI SDR(销售开发代表)。

Read more →


Yokoso

Yokoso

一款旨在帮助用户更好地适应日本生活的应用。

Read more →


Vinyl for Mac

Vinyl for Mac

将你的 Mac 变成一台旋转的黑胶唱片机。

Read more →


MOTHER

MOTHER

专为 Claude Code 设计的终端,支持一键恢复会话。

Read more →


Crodo AI

Crodo AI

一款专为 macOS 设计的语音优先 AI 助手。

Read more →


GrowthBook 5.0

GrowthBook 5.0

用于大规模构建、发布和改进产品的工具。

Read more →


Wondering

Wondering

被称为“学习任何事物的多邻国”。

Read more →


Hey Noah

Hey Noah

一款为创始人设计的、主动型的 AI 执行助理。

Read more →


AirProof AI

AirProof AI

一款能在几秒钟内帮你找到空气净化器最佳摆放位置的工具。

Read more →


MIT Technology Review

The Download: US robot restrictions, and ICE’s DNA grab

每日下载:美国机器人限制与 ICE 的 DNA 采集

本期简报涵盖了特朗普政府对机器人产业的保护主义政策,以及移民局采集 DNA 的相关争议。

Read more →


Trump’s AI protectionism has come for robotics

特朗普的 AI 保护主义已波及机器人产业

文章分析了美国政府对人形机器人产业的限制政策,指出尽管人形机器人目前仍处于笨拙的起步阶段,但已成为地缘政治博弈的焦点。

Read more →


The Download: reward hacking explained, and suspected Iranian cyberattacks

每日下载:奖励黑客行为解析与疑似伊朗网络攻击

本期简报解释了 AI 代理为何会为了达成目标而“撒谎和作弊”,并讨论了近期发生的网络安全事件。

Read more →


Here’s why AI agents lie and cheat to reach their goals

AI 代理为何会为了达成目标而撒谎和作弊

文章深入探讨了 AI 代理在追求目标时表现出的非预期行为,分析了其背后的逻辑缺陷及安全隐患。

Read more →


The Download: Montana’s new experimental drug rules

每日下载:蒙大拿州新的实验性药物规则

简报介绍了蒙大拿州旨在成为实验性医疗中心的最新立法进展。

Read more →


Montana’s new “right to try” law can’t come soon enough for some

蒙大拿州新的“尝试权”法案对某些人来说来得太晚了

文章讨论了蒙大拿州允许使用未经充分测试的实验性药物的法律,探讨了其在医疗伦理与患者需求之间的平衡。

Read more →


Montana’s plan to become an experimental medical hub just pushed forward

蒙大拿州成为实验性医疗中心的计划取得进展

蒙大拿州通过新规,为生物技术公司销售实验性药物开辟了清晰的路径,引发了关于医疗安全与创新的讨论。

Read more →


The Download: tricking LLMs, and reviving geothermal plants

每日下载:欺骗大语言模型与复兴地热发电厂

简报讨论了 LLM 的根本性安全漏洞,以及如何通过新技术复兴老旧的地热发电厂。

Read more →


A fundamental flaw leaves LLMs strikingly vulnerable to attack

一个根本性缺陷使大语言模型极易受到攻击

研究人员指出,由于 LLM 工作原理的根本性缺陷,使其无法完全防御黑客攻击,这对 AI 安全提出了严峻挑战。

Read more →


How an overlooked geothermal plant got a second chance

一家被忽视的地热发电厂如何获得第二次生命

通过新技术,一家濒临倒闭的地热发电厂成功恢复了满负荷运行,展示了可再生能源领域的创新潜力。

Read more →


TencentCloud / TencentDB-Agent-Memory

腾讯云 / TencentDB-Agent-Memory

TencentDB Agent Memory 是一个团队级的 AI 代理记忆中心,将对话、文档和代码转化为可重用的记忆资产(聊天记忆、技能、LLM-Wiki、代码图谱),供不同代理和框架共享与调用。

Read more →


zhaoxuya520 / reverse-skill

逆向工程/渗透测试/安全研究技能路由包

这是一个 AI 驱动的技能路由包,支持 Claude Code、Kiro、Cursor、Cline 等 AI 代码客户端,提供自动路由、按需工具链自举及自动进化的经验库。

Read more →


firecrawl / pdf-inspector

firecrawl / pdf-inspector

一个用于 PDF 检查、分类和文本提取的快速 Rust 库,能够智能识别扫描版与文本版 PDF,从而实现智能路由决策。

Read more →


uber / ADR

uber / ADR

Uber 开发的 ADR 系统,通过可观测性、安全基准测试和威胁检测来保障企业级 AI 代理的安全。

Read more →


microsoft / generative-ai-for-beginners

微软 / 生成式 AI 初学者指南

包含 21 节课程,旨在帮助初学者快速上手构建生成式 AI 应用。

Read more →


cypress-io / cypress

cypress-io / cypress

一款快速、简单且可靠的浏览器端自动化测试框架。

Read more →


lyogavin / airllm

lyogavin / airllm

AirLLM 允许在仅有 4GB 显存的 GPU 上运行 70B 参数的大语言模型推理。

Read more →


webpack / webpack

webpack / webpack

经典的 JavaScript 模块打包工具,支持代码分割和多种资源加载。

Read more →


gabime / spdlog

gabime / spdlog

一个高性能的 C++ 日志记录库。

Read more →


OpenAI Blog

Third-party cyber evaluations involving OpenAI models

涉及 OpenAI 模型的第三方网络安全评估

OpenAI 解释了近期第三方网络安全评估中出现的事故,并概述了加强 AI 模型测试与评估的新安全措施。

Read more →


New ways to learn and teach with ChatGPT Work and Codex

使用 ChatGPT Work 和 Codex 进行学习与教学的新方式

OpenAI 推出了新的教育插件,旨在帮助 K-12 教师、大学教育者和学生进行学习、教学、研究和构建项目。

Read more →


How we built a realtime system for responsive voice AI in six months

我们如何在六个月内构建响应式语音 AI 实时系统

GPT-Live 实现了与 AI 的持续语音交互,利用无轮次语音模型和低延迟架构,提供更快速、自然的对话体验。

Read more →


Circles powers telco personalization with OpenAI technology

Circles 利用 OpenAI 技术实现电信个性化服务

Circles 通过 OpenAI API 和 Codex 提升了电信体验,使 ARPU 增长 22%,流失率降低 9%,并显著提高了开发效率。

Read more →


Ten advances in mathematics and theoretical computer science

数学与理论计算机科学的十大进展

OpenAI 分享了在几何、密码学和复杂性理论等长期未解数学难题上的最新研究成果。

Read more →


Advancing responsible AI across Europe

在欧洲推进负责任的 AI

OpenAI 分享了其在安全、透明度和溯源方面的实践,以支持欧洲的负责任 AI 治理,并承诺将继续配合欧盟 AI 法案的推进。

Read more →


Building abundant intelligence

构建充沛的智能

OpenAI 阐述了其全栈方法,旨在使先进 AI 变得更强大、更经济且更广泛地服务于社会。

Read more →


Univé builds an AI-ready workforce

Univé 构建 AI 就绪型员工队伍

Univé 通过 ChatGPT Enterprise 结合领导力、治理和员工创新,实现了大规模的 AI 转型。

Read more →


Disrupting a Criminal Scam Operation

打击犯罪诈骗行动

OpenAI 成功打击了一个位于柬埔寨的犯罪团伙,该团伙利用 ChatGPT 进行投资、恋爱、赌博和冒充诈骗。

Read more →


Anthropic Blog

Introducing Claude Opus 5

介绍 Claude Opus 5

Opus 5 在 Opus 层级上实现了重大飞跃,不仅提升了长周期代理的性能,还在编码和专业工作领域带来了显著改进。

Read more →


Inviting hard questions

诚邀难题

Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决这些问题时保持透明,展示研究过程。

Read more →


Redeploying Fable 5

重新部署 Fable 5

Fable 5 于 7 月 1 日全球回归。Anthropic 同时联合亚马逊、微软、谷歌等合作伙伴,提议建立行业范围的越狱严重性评分框架。

Read more →


Introducing Claude Sonnet 5

介绍 Claude Sonnet 5

Sonnet 5 在编码、代理任务和专业工作方面提供了前沿性能,并支持大规模应用。

Read more →


Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer

Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任首席全球事务官

Read more →


Investigating three real-world incidents in our cybersecurity evaluations

调查网络安全评估中的三起现实事件

Read more →


Our position on open-weights models

我们对开源权重模型的立场

Read more →


Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients

Cognizant 与 Anthropic 扩大合作,将 Claude 带给企业客户

Read more →


A research agenda for the Economic Futures Research Fund

经济未来研究基金的研究议程

Read more →


Ask Claude about the Anthropic Economic Index

向 Claude 询问 Anthropic 经济指数

Read more →


Google AI Blog

The latest AI news we announced in July 2026

谷歌 2026 年 7 月发布的最新 AI 新闻

Read more →


Inside our 353,000-person vibe coding course

走进我们 35.3 万人的“氛围编程”课程

Kaggle 与谷歌合作举办的 AI 代理强化课程,旨在帮助学习者构建和部署下一代 AI。

Read more →


Gemini API Managed Agents: 3.6 Flash, hooks, and more

Gemini API 托管代理:3.6 Flash、钩子及更多功能

谷歌宣布 Gemini API 托管代理的新功能,助力开发者构建可靠的生产级代理。

Read more →


5 ways AI Mode in Search helps you enjoy the real world

AI 搜索模式助你享受现实世界的 5 种方式

Read more →


使用谷歌搜索举办终极晚宴的 5 种方法

Read more →


3 Google updates from Galaxy Unpacked 2026

银河发布会 2026 上的 3 项谷歌更新

Read more →


将更多应用连接到搜索

Read more →


Create, edit and star in videos with two Google Vids updates

通过两项 Google Vids 更新创建、编辑和主演视频

Read more →


Celebrating 25 years of visual search innovation

庆祝视觉搜索创新 25 周年

Read more →


Expanding Managed Agents in Gemini API: background tasks, remote MCP and more

扩展 Gemini API 托管代理:后台任务、远程 MCP 等

Read more →


Hugging Face Blog

Deploy local agents everywhere with LFM2.5-2.6B

使用 LFM2.5-2.6B 在各地部署本地代理

Read more →


GPU Management: Why Idle GPUs Are the New Grounded Aircraft

GPU 管理:为什么闲置 GPU 是新的“停飞飞机”

Read more →


The OlmoEarth Platform: Geospatial inference at planetary scale

OlmoEarth 平台:行星尺度的地理空间推理

Read more →


NVIDIA Cosmos-H-Dreams: Bringing Real-Time Generative Simulation to Surgical Robotics

NVIDIA Cosmos-H-Dreams:将实时生成式模拟引入手术机器人

Read more →


Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident

前沿实验室代理入侵剖析:2026 年 7 月事件的技术时间线

Read more →


Bringing Nunchaku 4-bit Diffusion Inference to Diffusers

将 Nunchaku 4 位扩散推理引入 Diffusers

Read more →


Grabette: an open system to record robot-manipulation data

Grabette:记录机器人操作数据的开源系统

Read more →


Newer Models, Same Advantage

更新的模型,同样的优势

Read more →


Security incident disclosure — July 2026

安全事件披露 — 2026 年 7 月

Read more →


Model Routing Is Simple. Until It Isn’t.

模型路由很简单,直到它变得复杂

Read more →


The Gradient

After Orthogonality: Virtue-Ethical Agency and AI Alignment

正交性之后:德性伦理代理与 AI 对齐

文章论证了理性的人并不一定有“目标”,因此理性的 AI 也不应被设定为以目标为导向,而应将行动与实践对齐。

Read more →


AGI Is Not Multimodal

AGI 不是多模态的

文章反思了当前生成式 AI 的局限性,指出将语言视为思维模型会导致我们忽视人类智能中隐含的具身理解。

Read more →


Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research

形状、对称性与结构:数学在机器学习研究中角色的转变

探讨了机器学习研究从数学原则驱动向计算密集型工程驱动的范式转移。

Read more →


What’s Missing From LLM Chatbots: A Sense of Purpose

LLM 聊天机器人缺失了什么:使命感

尽管 LLM 在基准测试中表现优异,但用户体验并未同步提升,文章探讨了 AI 缺失的“目的感”。

Read more →


We Need Positive Visions for AI Grounded in Wellbeing

我们需要基于福祉的 AI 正面愿景

文章呼吁构建以人类福祉为核心的 AI 发展愿景,而非仅仅关注技术能力的提升。

Read more →


Financial Market Applications of LLMs

LLM 在金融市场的应用

探讨了 LLM 在金融序列数据建模中的潜力与挑战。

Read more →


A Brief Overview of Gender Bias in AI

AI 中的性别偏见简述

Read more →


Mamba Explained

Mamba 原理解析

介绍了基于状态空间模型(SSM)的 Mamba 模型,作为 Transformer 处理长序列效率低下的替代方案。

Read more →


Car-GPT: Could LLMs finally make self-driving cars happen?

Car-GPT:LLM 能否最终实现自动驾驶?

探讨了 LLM 在自动驾驶中的应用前景及面临的关键挑战。

Read more →


Do text embeddings perfectly encode text?

文本嵌入能完美编码文本吗?

文章通过 Vec2text 技术展示了从嵌入还原文本的可能性,强调了嵌入数据安全协议的紧迫性。

Read more →


arXiv CS.AI

OpenClaw and Ollama in Agentic AI: Toward Fully Autonomous and Scalable AI Agent Systems

OpenClaw 与 Ollama 在代理 AI 中的应用:迈向完全自主且可扩展的 AI 代理系统

文章探讨了代理 AI 在推理、编排和执行层面的架构缺口,并提出了统一的框架。

Read more →


Can AI Evaluate AI Scientists? A Benchmarking Study of Autonomous Research Generation Systems Using Automated Multi-Model Review

AI 能评估 AI 科学家吗?基于自动多模型评审的自主研究生成系统基准研究

提出了一个严谨的基准协议,利用自动同行评审系统来评估 AI 生成论文的质量。

Read more →


LLM Framework for Discovering Major Mathematical Conjectures: AI’s Quest for the Next Riemann Hypothesis

用于发现重大数学猜想的 LLM 框架:AI 对下一个黎曼猜想的探索

提出了一个三阶段流水线,用于系统性地生成和验证具有重大数学潜力的猜想。

Read more →


ThinkReset: Learnable Intermediate Interface Construction for Bounded-Context Long-Horizon Reasoning

ThinkReset:用于有界上下文长程推理的可学习中间接口构建

针对长思维链推理中的冗余和上下文溢出问题,提出了可重用的中间接口构建方法。

Read more →


TAPR: Enhancing LLM Performance with a Task-Aware Prompt Rewriter

TAPR:通过任务感知提示重写器增强 LLM 性能

TAPR 模型能够将用户提示重写为任务优化提示,降低了非专家用户使用 LLM 的门槛。

Read more →


Empowering Cross-Domain Sequential Recommendation with Hybrid Tokenization and Serial-Parallel Decoding

通过混合分词与串并行解码赋能跨域序列推荐

针对跨域序列推荐(CDSR)问题,提出了基于语义标识符(SID)的生成式推荐方法。

Read more →


An Ontology-Guided, Deduplication-Aware Extraction Layer for Knowledge Graph Construction from Heterogeneous Documents

用于异构文档知识图谱构建的本体引导与去重感知提取层

解决了 LLM 在知识图谱构建中实体提取不一致、重复及混淆的问题。

Read more →


How Hard Does It Think? Analyzing Step-Aware Reasoning Energy in LLM Chain-of-Thought Trajectories

它思考得有多努力?分析 LLM 思维链轨迹中的步级推理能量

提出了分析思维链中每一步计算努力程度的方法,使推理过程的能量消耗透明化。

Read more →


arXiv CS.CL

Cost-Effective Automated Judging of Natural-Language Mathematical Proofs

自然语言数学证明的经济型自动评审

探讨了使用廉价开源模型作为数学证明评审员的可行性,以降低评估成本。

Read more →


RubricReviewer: From Direct Critique to Objective and Comprehensive Rubric-Driven Peer Review

RubricReviewer:从直接批评到客观全面的 rubric 驱动同行评审

解决了现有 LLM 评审员缺乏明确评审标准的问题,通过 rubric 驱动实现更客观的评审。

Read more →


MemoryForge: Synthesize Lifelong Memory for Human-Like LLM Agents

MemoryForge:为类人 LLM 代理合成终身记忆

通过合成终身记忆而非静态文本配置,使 AI 代理表现出更具真实感和连贯性的行为。

Read more →


AgentMemBench: A Systematic Benchmark for Evaluating Long-Term Memory Management Strategies in Conversational AI Agents

AgentMemBench:评估对话 AI 代理长期记忆管理策略的系统基准

提出了一个统一的基准,用于在相同条件下评估五种不同的记忆管理策略。

Read more →


DLLM-TTS: Block Discrete Diffusion Language Model for Text-to-Speech Synthesis

DLLM-TTS:用于语音合成的块离散扩散语言模型

在语音合成中平衡了自回归模型的准确性与非自回归模型的速度。

Read more →


Obshazard-bench: Benchmarking Multimodal Foundation Models for Real-Time Disaster Intelligence from Raw Earth Observation Streams

Obshazard-bench:从原始地球观测流中实时灾害情报的多模态基础模型基准

评估了多模态大模型在实时灾害应急响应中的能力。

Read more →


What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs

文本到视觉迁移了什么?视觉语言模型的性能缩放定律与迁移动态

探讨了选择 LLM 主干对 VLM 性能的影响,并提出了预测 VLM 性能的框架。

Read more →


Role Steering of Language Models for Social Simulations

用于社会模拟的语言模型角色引导

引入了一种激活引导筛选工作流,用于在社会模拟中对 AI 代理的角色行为进行预检查。

Read more →


WIRED

The White House Is Keeping Its AI Cybersecurity Framework Secret

白宫对 AI 网络安全框架保密

特朗普政府已与 OpenAI、Anthropic 等实验室分享了该计划细节,但公众目前仍被蒙在鼓里。

Read more →


Landmark Deal Would Officially Add Laser Weapons to US Army Arsenal

里程碑式协议将正式把激光武器纳入美国陆军军火库

面对日益增长的无人机威胁,五角大楼准备签署首个“持久高能激光”合同,使定向能武器成为陆军的正式装备。

Read more →


The Best Gaming Mouse You Can Buy After Testing Dozens of Models

测试数十款模型后选出的最佳游戏鼠标

Read more →


Purple Carrot Meal Kit Review: Tastier Than Meal Kits With Meat

Purple Carrot 餐包评测:比含肉餐包更美味

Read more →


The Best Cordless Vacuums (2026): My Brand-New Top Pick

2026 年最佳无线吸尘器:我的全新首选

Read more →


Is This Poker Player Bluffing? The AI Thinks So

这个扑克玩家在虚张声势吗?AI 认为是的

ESPN 在 2026 年世界扑克系列赛直播中引入了“AI 虚张声势检测”工具,引发了关于其对扑克未来影响的讨论。

Read more →


How One Startup Built a (Mostly) China-Free Robot

一家初创公司如何制造出(基本)不含中国零件的机器人

Ati Robotics 在印度组装机器人,并尽量减少中国零件的使用,以应对特朗普政府对中国人形机器人的打击。

Read more →


‘Everyone Is Doing It’: The Truth About AI in Hollywood

“每个人都在做”:好莱坞 AI 的真相

AI 已悄然成为电影制作的一部分,现在的争论焦点不再是是否使用 AI,而是谁来控制 AI 的未来。

Read more →


How Data Centers Broke American Politics

数据中心如何破坏了美国政治

文章探讨了 2026 年数据中心背后的政治反弹,分析了科技基础设施对社会政治的影响。

Read more →


The Real Story Behind the 2018 Google Walkout

2018 年谷歌罢工背后的真实故事

回顾了 2018 年超过 2 万名员工罢工抗议公司处理性骚扰指控的组织过程。

Read more →


Lobsters

The Lua community needs to learn to move on

Lua 社区需要学会向前看

Read more →


Soppo - Go, with the features it’s missing

Soppo - 补全了 Go 缺失功能的编程语言

Read more →


Security is Hard, Y’all

安全很难,伙计们

Read more →


Liquid Glass effect for GNU/Emacs

GNU/Emacs 的液态玻璃效果

Read more →


Enabling the next iteration of the borrow checker on nightly

在 nightly 版本中启用下一代借用检查器

Read more →


IntelliJ IDEA Goes LSP: Java and Kotlin Intelligence Comes to VS Code, Cursor, and Agentic Flows

IntelliJ IDEA 拥抱 LSP:Java 和 Kotlin 智能支持登陆 VS Code、Cursor 及代理工作流

Read more →


Read more →


The Nix sandbox is a hidden input

Nix 沙盒是一个隐藏的输入

Read more →


Tests for a PDF

PDF 测试

Read more →


DEV Community

I Added a Tag in AWS. Terraform Removed It Automatically.

我在 AWS 中添加了一个标签,Terraform 自动将其删除了

作者分享了关于基础设施即代码(IaC)漂移检测的经验,强调了在自动化运维中闭环管理的重要性。

Read more →


I Compared the Free Tiers of Google Flow, Kling AI, and Hailuo So You Don’t Have To

我对比了 Google Flow、Kling AI 和 Hailuo 的免费层级,省得你去试了

作者深入调研了三大 AI 视频工具的免费额度及限制,为想要进行商业化创作的用户提供了参考。

Read more →


[Advanced Rust] 2.4. API Design Principles of Unsurprising Pt.4 - Ergonomic Trait Implementations, Wrapper Types, and Borrow Trait

[Rust 进阶] 2.4. API 设计原则:符合直觉(第四部分)

探讨了 Rust 中符合直觉的 API 设计,包括人体工程学 Trait 实现、包装类型及 Borrow Trait 的使用。

Read more →


Building Fast with Claude Code Is Easy. Securing the App Is the Hard Part

用 Claude Code 构建应用很快,但保障应用安全很难

作者分享了在个人项目中使用 Claude Code 的经验,并强调了在 AI 辅助开发中引入授权和访问控制测试的重要性。

Read more →


Git Diff for Human Reasoning

人类推理的 Git Diff

文章探讨了当两个聪明人对同一证据得出不同结论时,我们应该如何通过“推理差异”而非仅仅对比结论来理解彼此。

Read more →


Do Not Hire an AI Test Agent From Its Demo

不要仅凭演示就雇佣 AI 测试代理

作者警告称,AI 测试代理的演示往往只展示“快乐路径”,无法反映实际生产环境中的维护成本和复杂性。

Read more →


The Test Automation Tax Nobody Budgets For

没人预算的测试自动化税

分析了测试自动化在长期维护中产生的隐性成本,提醒团队不要忽视项目变更后的测试维护负担。

Read more →


Notion meeting notes em sistemas Linux, ou, como o PipeWire venceu a preguiça de portar o Notion para Linux.

Linux 系统上的 Notion 会议笔记,或者 PipeWire 如何克服了 Notion 不支持 Linux 的懒惰

作者通过创建虚拟音频 sink,解决了 Notion Web 版在 Linux 上无法捕获系统音频的问题。

Read more →


How to Configure a Custom LLM Proxy in OpenOPC (and Debug LiteLLM)

如何在 OpenOPC 中配置自定义 LLM 代理(并调试 LiteLLM)

作者分享了在 OpenOPC 框架中连接自定义 OpenAI 兼容代理以节省 API 成本的实践经验。

Read more →


My Agent Said the Page Was Live. The Page Said ‘We Are Closed.‘

我的代理说页面已上线,但页面显示“我们已关门”

作者通过案例说明了 AI 代理在缺乏实际渲染界面检查的情况下,仅凭 HTTP 200 状态码做出判断是不可靠的。

Read more →


Meta Engineering

GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model

GEM 训练:Meta 如何将其 LLM 规模广告基础模型的效率翻倍

Meta 介绍了如何通过优化 GPU 利用率,将 Instagram 和 Facebook 广告推荐模型(GEM)的训练效率提升至 20-25%。

Read more →


Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization

探索 Meta 广告深层漏斗优化的分层兴趣表示

Meta 正在研究一种上游表示层,通过学习连接用户兴趣与广告实体的统一嵌入,优化广告推荐效果。

Read more →


Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler

使用开源内核调度器现代化 Meta 广告服务

Meta 利用基于 BPF 的可扩展调度框架 sched_ext,为广告服务 fleet 构建了定制化的调度策略,以解决内核升级带来的延迟问题。

Read more →


Meta’s AI Storage Blueprint at Scale

Meta 大规模 AI 存储蓝图

文章探讨了在 AI 模型和数据集呈指数级增长的背景下,Meta 如何构建可靠且快速的存储基础设施。

Read more →


10 Years of Meta’s Commitment to Python

Meta 对 Python 的 10 年承诺

Meta 庆祝其连续 10 年赞助 Python 软件基金会,强调了 Python 在其工程体系中的核心地位。

Read more →


Privacy-Aware Infrastructure in the AI-Native Era: An Asset Classification Case Study

AI 原生时代的隐私感知基础设施:资产分类案例研究

探讨了在 AI 时代,如何通过可靠的数据理解来实施有效的隐私控制策略。

Read more →


How Meta Engineered Ultra-Narrow Batteries for AI Glasses

Meta 如何为 AI 眼镜设计超窄电池

介绍了 Meta 如何在 Ray-Ban Meta 等智能眼镜的镜腿中集成足够驱动 AI 工作负载的电池。

Read more →


Adopting AV1 for Real-Time Communication (RTC) at Scale

大规模采用 AV1 进行实时通信

分享了 Meta 在部署 AV1 编解码器以提升实时通信质量过程中的技术挑战与解决方案。

Read more →


Lights Out, Systems On: Validating Instant Power Loss Readiness

关灯,系统运行:验证瞬时断电准备情况

Meta 引入了“瞬时断电风暴”测试范式,以验证其数据中心在零通知断电情况下的容错能力。

Read more →


DeepMind Blog

Gemini Robotics ER 2: powering robotics with video understanding, task orchestration, and multi-robot collaboration

Gemini Robotics ER 2:通过视频理解、任务编排和多机器人协作赋能机器人

Gemini Robotics ER 2 帮助机器人进行推理、协作并解决现实世界任务,在视频理解和工具编排方面实现了质的飞跃。

Read more →


We’re launching Lyria 3.5 in Google Flow Music, with advances across musicality, lyrics, vocals, and creative control

我们在 Google Flow Music 中发布 Lyria 3.5,在音乐性、歌词、人声和创作控制方面取得进展

Read more →


Gemini Robotics 2 brings whole body intelligence to robots

Gemini Robotics 2 为机器人带来全身智能

Read more →


Accelerating the frontiers of scientific discovery: Google’s $40M commitment to the Genesis Mission

加速科学发现的前沿:谷歌为 Genesis 任务承诺 4000 万美元

谷歌承诺提供 4000 万美元的 AI 代币和积分,支持 Genesis 科学任务。

Read more →


Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber

介绍 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber

Read more →


Introducing Gemini 3.5 Flash Cyber

介绍 Gemini 3.5 Flash Cyber

谷歌推出轻量级网络安全模型 Gemini 3.5 Flash Cyber,专门用于发现和修补漏洞。

[Read more →

生成二维码中...

请点击右上角 ···

选择 发送给朋友收藏