2026-08-12
今日要点
- AI 规模化里程碑:Google Gemini 与 OpenAI ChatGPT 的月活跃用户数均突破 10 亿大关,标志着 AI 助手已成为全球主流生产力工具。
- AI 代理(Agent)生态爆发:从 Anthropic 的 Cowork 到 Google 的 Spark,AI 代理正从简单的聊天机器人转向能够自主操作文件、代码及企业流程的“行动派”。
- 行业人事动荡:OpenAI 高层持续变动,首席运营官 Brad Lightcap 及伦理部门负责人相继离职,引发外界对公司战略方向的关注。
- 安全与合规挑战:研究人员发现通过少量提示词即可劫持 Zoom 会议设备,同时 AI 辅助开发带来的代码安全与数据隐私问题成为行业焦点。
- 科研与医疗突破:Google AMIE 系统在临床视频咨询中展现潜力,英国有望成为全球首个消除丙型肝炎的国家。
Hacker News
France to ban unsolicited telemarketing calls
法国禁止未经请求的电话营销
法国政府已正式实施禁令,禁止未经用户许可的电话营销呼叫。此举旨在保护公民隐私,减少骚扰电话对日常生活的干扰,并强制要求营销机构在进行商业推广前必须获得明确的授权。
As AI eats the web, the internet’s collective memory is disappearing
随着 AI 吞噬网络,互联网的集体记忆正在消失
文章探讨了 AI 爬虫对互联网生态的负面影响。随着 AI 模型大量抓取网页内容,传统的搜索引擎流量被截流,导致许多优质网站因缺乏访问量而关闭,互联网的“集体记忆”正面临碎片化和永久丢失的风险。
The UK’s war on anonymity has come to America
英国的匿名性战争已蔓延至美国
调查显示,多个外国非政府组织正通过游说美国立法者,以“儿童安全”为名推动数字身份法案。该策略旨在限制互联网匿名性,要求用户在访问网络时进行身份验证,这引发了对数字隐私和言论自由的广泛担忧。
England set to be one of the first countries to eliminate hepatitis C
英国有望成为首批消除丙型肝炎的国家之一
最新数据显示,英国在抗击丙型肝炎方面取得显著进展,已达到治疗 80% 已知病例的目标。过去十年中,该病毒导致的死亡人数下降了 36%,英国正稳步迈向 2030 年前彻底消除该疾病的目标。
Stealing Reasoning Traces from Proprietary LLM APIs
从专有 LLM API 中窃取推理轨迹
研究人员展示了一种从 OpenAI、Anthropic 和 Google 等前沿模型 API 中提取“隐藏思维链”的方法。通过分析 API 返回的思维令牌数量,研究者能够解码模型在解决复杂编程问题时的推理过程。
H3-metal – Native MiniMax-H3 inference for Apple Silicon
H3-metal:Apple Silicon 上的原生 MiniMax-H3 推理
该项目旨在为 Apple Silicon 芯片提供原生的 MiniMax-H3 模型推理支持。项目通过 Metal 框架实现高效的计算加速,涵盖了从元数据处理到提示词编码、视频/音频生成及帧条件控制的完整流程。
Chicken Scheme 6.0
Chicken Scheme 6.0 版本正式发布,作为一种高性能的 Scheme 编程语言实现,新版本在编译器优化和标准兼容性方面进行了重大升级,进一步提升了开发者的编程体验。
Show HN: Scroll through all 43252003274489856000 Rubik’s Cube states
Show HN:滚动浏览魔方所有 43,252,003,274,489,856,000 种状态
这是一个极具创意的项目,允许用户在线浏览魔方所有可能的排列组合状态。该网站通过数学算法展示了魔方庞大的状态空间,为数学爱好者提供了一个直观的探索工具。
Apple Silicon and macOS VMs: Faster LLM Inference with llama.cpp
Apple Silicon 与 macOS 虚拟机:使用 llama.cpp 实现更快的 LLM 推理
文章介绍了在 macOS 虚拟化环境下利用 llama.cpp 优化大模型推理性能的技术方案。通过对虚拟化堆栈的改进,开发者可以在 macOS 虚拟机中获得接近原生的 AI 模型运行速度。
Nvidia’s Risky Business
英伟达的风险生意
文章回顾了历史上的大型基础设施投资案例,并将其与英伟达当前的 AI 硬件扩张策略进行对比。作者警示,过度依赖单一增长引擎可能在未来市场波动中带来巨大的系统性风险。
More than 10 firms pay up to $100k a month for access to Truth Social posts
超过 10 家公司每月支付高达 10 万美元以获取 Truth Social 的帖子
特朗普媒体旗下的 Truth API 服务引发争议,该服务允许华尔街交易员以每月 10 万美元的价格获取 Truth Social 平台上具有市场影响力的帖子,旨在提供比普通用户更快的市场信息获取渠道。
Woman pulled over twice after Flock-linked software connected her to homicide
因 Flock 关联软件误报,一名女子两次被警方拦截
由于 Flock 摄像头系统的识别错误,一名无辜女性被系统错误地关联到一起凶杀案中,导致其在短时间内两次被警方拦截。该事件引发了公众对自动化执法工具准确性和过度依赖算法的质疑。
Mojo 1.0
Mojo 1.0 正式发布,标志着该语言从 2023 年发布以来迈向了成熟。作为一种专为 AI 开发设计的通用编程语言,Mojo 1.0 提供了更完善的库支持和工具链,旨在为开发者构建高性能 AI 应用提供长期稳定的基础。
Go is an ideal language for AI-assisted software engineering
Go 是 AI 辅助软件工程的理想语言
文章指出,随着 AI 编程助手生成代码的普及,人类开发者需要承担更多的代码审查和验证工作。Go 语言凭借其简洁的语法和强大的工具链,成为 AI 生成代码后进行人工维护和验证的理想选择。
OpenAI’s head of ethics leaves less than a year after joining
OpenAI 伦理部门负责人在入职不到一年后离职
OpenAI 的伦理部门负责人 Chloe Bakalar 在入职不到一年后宣布离职。这一人事变动再次引发了外界对于 OpenAI 在追求快速 AI 发展的同时,是否能够保持足够伦理审查力度的讨论。
TechCrunch
Phoebe Gates and Sophia Kianni reportedly knew Phia was ‘cookie stuffing’ for months
据报道,Phoebe Gates 和 Sophia Kianni 数月前已知晓 Phia 存在“Cookie 填充”行为
由 Phoebe Gates 和 Sophia Kianni 联合创办的购物初创公司 Phia 再次陷入争议。据报道,公司高层数月前便已知晓其业务中存在违规的“Cookie 填充”推广行为,这引发了对其商业道德的质疑。
Accel closes oversubscribed $550M India fund within weeks, 19 months after its last
Accel 在上一支基金募集 19 个月后,数周内完成 5.5 亿美元印度基金的超额认购
尽管上一支 6.5 亿美元的印度基金仍有超过 55% 的资金未投入,知名风投机构 Accel 依然在数周内迅速完成了新一轮 5.5 亿美元印度基金的募集,显示出资本对印度科技市场的持续看好。
Uber surprised robotics company Serve by selling its entire stake
Uber 出售全部股份,令机器人公司 Serve 感到意外
Uber 突然出售了其在机器人公司 Serve 的全部股份,这一举动令 Serve 感到措手不及。据悉,双方在业务战略上的分歧是导致此次撤资的主要原因。
FBI says cybercriminals are hacking into victims’ online accounts to steal their intimate pictures
FBI 称网络犯罪分子正入侵受害者账户以窃取私密照片
FBI 发布预警称,网络犯罪分子正通过入侵个人账户,专门窃取受害者(包括未成年人)的私密照片,并以此进行勒索。FBI 呼吁用户加强账户安全防护,启用多重身份验证。
OpenAI launches ChatGPT desktop app for Linux
OpenAI 发布 ChatGPT Linux 桌面应用
OpenAI 正式为 Linux 操作系统推出了专用的 ChatGPT 桌面应用程序,旨在为 Linux 用户提供更便捷的 AI 交互体验,进一步扩大其桌面端覆盖范围。
Google’s Gemini app surges to 1 billion users
Google Gemini 应用用户数激增至 10 亿
Google 宣布 Gemini 应用月活跃用户数已突破 10 亿大关。数据显示,63% 的用户倾向于使用语音功能与 AI 交流,且 Gemini 每天生成的图像数量超过 1.5 亿张,显示出极高的用户粘性。
Bluesky’s active user base is shrinking as its focus expands beyond the app
随着业务重心向应用外扩展,Bluesky 的活跃用户群正在萎缩
在经历了一波选后增长高峰后,社交平台 Bluesky 的移动端活跃用户数出现持续下滑。尽管核心社区依然保持活跃,但平台正试图通过扩展应用外功能来寻找新的增长点。
What’s Scaleup Europe, the $5.7B fund that just backed satellite company ICEYE?
什么是 Scaleup Europe?这支 57 亿美元基金刚刚投资了卫星公司 ICEYE
Scaleup Europe 是一支目标规模达 57 亿美元的公私合营基金。该基金近日完成了首笔投资,注资芬兰卫星技术公司 ICEYE,旨在支持欧洲高科技产业的规模化发展。
Brad Lightcap, OpenAI’s longtime COO, is leaving to ‘start something new’
OpenAI 资深 COO Brad Lightcap 离职,称将“开启新征程”
在 OpenAI 工作了八年的资深高管、首席运营官 Brad Lightcap 宣布离职。他在内部备忘录中表示,自己将去探索新的领域,并承诺将继续从外部支持 OpenAI 的使命。
General Catalyst leads $1.1B round into 2-month-old River AI
General Catalyst 领投成立仅两个月的 River AI,融资 11 亿美元
由 xAI 联合创始人 Igor Babuschkin 创立的初创公司 River AI 在成立仅两个月后,便获得了由 General Catalyst 领投的 11 亿美元融资。该公司致力于开发个人 AI 代理,愿景宏大。
The Verge
An FCC filing points to new Sonos headphones coming soon
FCC 文件显示 Sonos 新款耳机即将发布
根据 Sonos 向 FCC 提交的备案文件,型号为 S52A 的新款无线耳机即将面世。Sonos CEO Tom Conrad 此前在财报会议中暗示,Ace 耳机的继任者预计将于今年秋季推出。
ChatGPT and Gemini both just passed 1 billion users
ChatGPT 和 Gemini 用户数双双突破 10 亿
AI 领域迎来里程碑时刻,ChatGPT 和 Google Gemini 的月活跃用户数均已达到 10 亿。这标志着 AI 聊天机器人已从极客玩具转变为全球数十亿人的日常数字伴侣。
Threads has a VR app now
Threads 现已推出 VR 应用
Meta 正式在 Meta Quest VR 头显上推出了 Threads 应用。此举紧随 Threads 登陆 Ray-Ban 智能眼镜之后,进一步完善了 Meta 的跨平台社交生态,目前该平台月活用户已超 5 亿。
Google’s free streaming service now lets you pick shows and movies to watch
Google 免费流媒体服务现支持点播观看
Google TV Freeplay 服务迎来重大更新,从原先的轮播频道模式升级为支持视频点播(VOD)。用户现在可以从超过 10,000 部电影和电视节目中自由选择观看内容。
Another OpenAI executive takes off
又一位 OpenAI 高管离职
继 COO 离职后,OpenAI 特别项目负责人 Brad Lightcap 也宣布结束其八年的任期。频繁的高管变动引发了外界对 OpenAI 内部管理稳定性的讨论。
The budget-friendly Pixel Buds 2a are even cheaper right now
经济实惠的 Pixel Buds 2a 现正降价促销
Google Pixel Buds 2a 耳机目前在亚马逊、百思买及 Google 官网开启促销,价格降至 99 美元(原价 129 美元)。这款耳机以其出色的 Android 系统兼容性和轻便设计受到用户欢迎。
Google’s upcoming Pixel phones are for the fans, even if its launch event isn’t
Google 即将推出的 Pixel 手机是为粉丝准备的,尽管发布会可能并非如此
尽管去年的 Pixel 10 发布会因过多的名人客串和尴尬的短剧而受到批评,但即将发布的 Pixel 11 系列依然备受期待。新款 Pro 机型将配备背部闪烁灯,并带来全新的折叠屏和手表产品。
Made by Google 2026: all the Pixel news and announcements
Made by Google 2026:所有 Pixel 新品发布汇总
Google 在 8 月 12 日的发布会上展示了全新的 Pixel 11 系列手机、下一代 Pixel Fold 折叠屏手机以及 Pixel Watch 5。新产品在设计和功能上均有显著提升,旨在巩固 Google 在硬件市场的地位。
Apple could help you prove your iPhone photos aren’t deepfakes
Apple 或将帮助用户证明 iPhone 照片并非深度伪造
iOS 27 Beta 5 代码显示,Apple 正在开发一项名为“Apple Reference Image”的功能。该系统可在拍摄时将来源元数据嵌入照片,帮助用户验证照片的真实性,从而有效抵御深度伪造(Deepfake)带来的信任危机。
‘Zoomsday’ hack uncovered using fewer than 20 AI prompts
“Zoomsday”漏洞被发现,仅需不到 20 个 AI 提示词即可触发
研究人员发现 Zoom 存在一个严重安全漏洞,攻击者可通过 AI 模型生成的不到 20 个提示词,利用 Zoom 的注释功能劫持参与者的设备。Zoom 目前已修复该漏洞。
Ars Technica
Meta can’t stop states’ $1.4 trillion lawsuit from going to trial
Meta 无法阻止各州对其提起的 1.4 万亿美元诉讼进入审判阶段
法官裁定,Section 230 条款仅能作为 Meta 的辩护理由,而非免责金牌。这意味着 Meta 必须面对各州对其提起的总额高达 1.4 万亿美元的诉讼,该案将正式进入审判程序。
Gemini becomes Google’s fastest-growing product ever as it hits 1B users
Gemini 突破 10 亿用户,成为 Google 史上增长最快的产品
Gemini 创造了 Google 产品增长的新纪录。然而,随着 AI 模型发布节奏的放缓,分析师质疑这种爆发式增长是否能够持续,以及 Google 如何在竞争激烈的 AI 市场中保持领先。
Used EV buying guide: The $30,000 edition
二手电动汽车购买指南:3 万美元预算版
文章为预算在 3 万美元左右的消费者提供了二手电动汽车购买建议。根据车型不同,市场上的选择从丰富到稀缺不等,作者详细分析了各款车型的性价比与维护成本。
Less than 2.5% of Taylor Farms’ recalled lettuce went to Taco Bells
召回的 Taylor Farms 生菜中仅有不到 2.5% 流向了 Taco Bell
FDA 的最新报告揭示了 Taylor Farms 召回生菜的流向。数据显示,仅有极小比例的受污染生菜进入了 Taco Bell 门店,这一发现引发了公众对食品供应链透明度和安全管理的进一步讨论。
Tracking extreme heat by the hour makes climate change seem even worse
按小时追踪极端高温让气候变化显得更加严峻
研究表明,如果按小时而非日均温度来追踪极端天气,气候变化的影响将更加触目惊心。未来几十年内,夏季极端高温时段可能会增加两倍,对人类健康和基础设施构成巨大挑战。
A Google insider spills the tea on how the company forsook its founding ideals
Google 内部人士揭露公司如何背离其创始理念
Claire Stapleton 在其新书《Don’t Be Evil》中,讲述了自己从 Google 的忠实拥护者转变为公开批评者的心路历程,详细披露了公司在追求利润过程中逐渐背离“不作恶”初衷的内幕。
Trump to give Republicans a 3-1 FCC majority, isn’t filling empty Democratic seat
特朗普将使共和党在 FCC 占据 3-1 多数席位,且不打算填补民主党空缺
尽管在最高法院胜诉,特朗普仍决定不填补 FCC 的民主党空缺席位,这将使共和党在 FCC 委员会中形成 3-1 的绝对多数,预计将对未来的电信和网络监管政策产生深远影响。
New surveillance tech links your phone to your license plate
新型监控技术将手机与车牌关联
研究发现,新型监控技术能够通过手机和蓝牙信号,将路边的摄像头与车辆牌照进行精准关联。这种技术极大地增强了监控系统的追踪能力,引发了对个人隐私保护的严重担忧。
New Pass-ta-key attack reveals all the things we didn’t know about passkeys
新型“Pass-ta-key”攻击揭示了关于通行密钥(Passkeys)的未知漏洞
研究人员发现了一种名为“Pass-ta-key”的新型攻击方式,揭示了通行密钥在不同操作系统(尤其是 Windows)上的实现差异。该研究提醒开发者在部署通行密钥时需注意跨平台安全一致性。
Live now: Ross Scott discusses the Stop Killing Games movement
直播中:Ross Scott 讨论“停止扼杀游戏”运动
Ross Scott 在直播中深入探讨了“停止扼杀游戏”(Stop Killing Games)运动。该运动旨在呼吁游戏厂商在停止服务器支持后,必须提供离线游玩方案,以保护消费者的数字资产权益。
Product Hunt
ScreenMark
一款菜单栏应用,支持实时屏幕标注、白板覆盖等功能,旨在提升远程协作和演示的效率。
AMP by CanyonTechs AI
一套 AI 代理自动化解决方案,专注于执行复杂任务并提供可交付的自动化成果。
Vizard Agent
号称首个视频 AGI 代理,旨在处理各种类型的视频编辑和生成任务,简化视频创作流程。
agent-manager
一个旨在加速 AI 开发工作流的工具,帮助开发者更高效地管理和部署 AI 代理。
Tines 3B
一个为 AI 代理、应用程序和自动化任务提供安全运行环境的平台。
BetterClaw
一个可以在 60 秒内完成部署的 AI 代理平台,主打永久免费的入门门槛。
Bullet
一款 AI 编程工具,声称比 Claude Code 和 Codex 快 30-60%,专注于提升开发效率。
Cerenovus
一款财务分析工具,旨在帮助企业主动发现并挽回潜在的资金流失。
AdmitRaven
被称为“大学申请界的 Duolingo”,通过 AI 辅助帮助学生完成复杂的大学申请流程。
Xirp
由 Spotify 构建的代理开发环境,旨在为开发者提供更专业的 AI 代理构建工具。
MIT Technology Review
How the “censorship-industrial complex” is changing the Internet and US policy
“审查工业复合体”如何改变互联网与美国政策
文章探讨了“审查工业复合体”这一概念的兴起。该理论认为,美国政府内部存在一个旨在监控和反制外国虚假信息的机构网络,其运作方式正深刻影响着互联网内容治理和美国的相关政策。
The Download: the next big thing in LLMs and how AI academic research is shifting
每日下载:LLM 的下一个风口与 AI 学术研究的转型
本期简报分析了 Transformer 架构九年后的演变,探讨了初创公司如何追逐 LLM 的下一波技术浪潮,以及 AI 学术研究在算力竞赛背景下的范式转移。
AI professors are negotiating the new realities of academic research
AI 教授们正在适应学术研究的新现实
文章记录了 AI 领域顶尖学者在 Mountain View 的聚会,探讨了在算力资源高度集中于大厂的背景下,学术界如何保持研究的独立性与创新性。
The Download: AI agents for science, and the “censorship-industrial complex”
每日下载:科学 AI 代理与“审查工业复合体”
本期简报重点介绍了 Eric Schmidt 关于“科学 AI 需要推理而非仅仅是数据”的观点,并深入分析了审查网络理论如何从边缘走向主流政策。
AI for science needs reasoning, not just data
科学 AI 需要推理,而不仅仅是数据
Eric Schmidt 与 Suhas Mahesh 撰文指出,AI 在科学领域的应用不能仅依赖海量数据,必须具备深度的逻辑推理能力,才能真正推动科学发现的边界。
These startups are chasing the next big thing in LLMs
这些初创公司正在追逐 LLM 的下一个风口
文章回顾了 2017 年“Attention Is All You Need”论文的影响,并盘点了当前致力于超越现有 Transformer 架构、探索 LLM 下一阶段技术突破的初创公司。
The Download: a censorship conspiracy theory and the first virus created by AI
每日下载:审查阴谋论与首个 AI 制造的病毒
本期简报讨论了“审查工业复合体”叙事如何从右翼圈子进入特朗普政府政策,并提及了 AI 在网络安全领域带来的潜在威胁。
How ideas of a vast censorship network moved from the online fringe to Trump policy
庞大审查网络的构想如何从网络边缘走向特朗普政策
文章详细调查了美国国务院内部机构的关闭过程,分析了“审查工业复合体”这一阴谋论如何被政治化,并最终影响了政府的行政决策。
The Download: Google’s AI shake-up and Meta’s rogue model
每日下载:Google 的 AI 大洗牌与 Meta 的“流氓”模型
本期简报分析了 Google 在人才流失和模型发布延迟压力下的组织架构调整,以及 Meta 开源模型带来的行业影响。
Puzzle Corner
谜题角
MIT 科技评论的经典栏目,发布了 2026 年 9/10 月期的谜题,邀请读者挑战数学与逻辑难题。
GitHub Trending
msitarzewski / agency-agents
一个旨在提供完整 AI 代理生态的仓库,涵盖了从前端开发到社区运营的多种专家代理,具备个性化和可交付的成果。
semantica-agi / semantica
一个图原生基础设施,旨在为上下文感知和可追溯的 AI 系统提供支持。
nvm-sh / nvm
Node Version Manager,POSIX 兼容的 bash 脚本,用于管理多个 Node.js 版本。
addyosmani / agent-skills
一个生产级工程技能库,专门为 AI 编程代理提供能力支持。
ZhuLinsen / daily_stock_analysis
一个 LLM 驱动的多市场股票智能分析系统,支持实时新闻抓取、决策看板和自动推送。
vitali87 / code-graph-rag
一个专为大型代码库(Monorepo)设计的 RAG 系统,利用知识图谱帮助 AI 理解和编辑多语言代码。
anthropics / skills
Anthropic 官方发布的代理技能库,用于标准化 AI 代理的能力接口。
3b1b / manim
著名的数学动画引擎,用于制作高质量的数学解释视频。
HKUDS / DeepTutor
DeepTutor 项目,旨在提供终身个性化的 AI 辅导服务。
stablyai / orca
一个用于管理并行代理集群的 ADE(代理开发环境),支持在桌面、移动端和 VPS 上运行。
OpenAI Blog
Testing ads in ChatGPT
在 ChatGPT 中测试广告
OpenAI 开始在 ChatGPT 中测试广告功能,旨在支持免费用户的访问。公司承诺将提供清晰的标签、保持回答的独立性,并提供强大的隐私保护和用户控制选项。
Daybreak models are now available on AWS
Daybreak 模型现已登陆 AWS
OpenAI 与 AWS 合作,将 Daybreak 网络安全能力引入 Amazon Bedrock,以支持企业的安全工作流。
OpenAI’s letter to Governor Abbott on responsible AI infrastructure in Texas
OpenAI 致德克萨斯州州长 Abbott 关于负责任 AI 基础设施的信
OpenAI 致信德克萨斯州州长,表达了对在该州建设负责任 AI 基础设施的承诺,支持可靠、透明的增长,以造福当地民众。
Model ML completes finance work more efficiently with GPT-5.6 Sol
Model ML 利用 GPT-5.6 Sol 更高效地完成财务工作
Model ML 利用 GPT-5.6 Sol 模型,实现了从财务研究、分析到自动生成可编辑的 PowerPoint 和 Excel 报表的完整自动化流程。
What building an AI-native finance function taught me
构建 AI 原生财务职能的经验分享
OpenAI CFO Sarah Friar 分享了构建 AI 原生财务部门的五大经验,涵盖了从自动预测到强化控制及 AI 投资回报率评估等关键领域。
Expanding Daybreak as the Cyber Defense Window Narrows
随着网络防御窗口缩小,Daybreak 持续扩展
OpenAI 推出了 GPT-5.6-Cyber 模型,专门用于漏洞研究、漏洞验证和安全测试,通过 Daybreak Red 平台向授权合作伙伴提供。
Putting frontier cyber models in more trusted hands
将前沿网络安全模型交到更值得信赖的手中
OpenAI 允许经过审核的 Daybreak 合作伙伴使用其前沿网络安全模型,为客户提供受监管的专业安全服务。
Premium seats are coming to ChatGPT Business
ChatGPT Business 即将推出高级席位
ChatGPT Business 将引入高级席位。在 8 月 20 日前注册的用户可获得 100 美元的工作区积分,并解锁更高使用限额。
How Zapier transformed core marketing processes with ChatGPT Work
Zapier 如何利用 ChatGPT Work 转型核心营销流程
Zapier 的企业营销团队利用 ChatGPT Work 减少了潜在客户流失,并实现了营销资产构建和报告生成的自动化。
Virgin Atlantic sharpens customer journeys with ChatGPT Work
维珍大西洋航空利用 ChatGPT Work 优化客户旅程
维珍大西洋航空通过 ChatGPT Work 加速了研究、产品规划和决策过程,帮助团队更好地连接客户旅程中的各个环节。
Anthropic Blog
Introducing Claude Opus 5
推出 Claude Opus 5
Opus 5 实现了 Opus 级别的重大飞跃,在支持长周期运行的代理任务的同时,显著提升了代码编写和专业工作的表现。
Inviting hard questions
欢迎提出难题
Anthropic 邀请公众提出关于 AI 的最棘手问题,并承诺在解决这些问题时保持透明,展示其研究过程。
Redeploying Fable 5
重新部署 Fable 5
Fable 5 于 7 月 1 日全球上线。Anthropic 同时联合亚马逊、谷歌等合作伙伴,提议建立行业统一的越狱严重性评分框架。
Introducing Claude Sonnet 5
推出 Claude Sonnet 5
Sonnet 5 在代码编写、代理任务和专业工作方面提供了前沿的性能表现,并支持大规模应用。
Improving Fable 5’s biology safeguards
改进 Fable 5 的生物安全防护
Anthropic 持续强化 Fable 5 的生物安全机制,以防止模型被滥用于生物威胁研究。
Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer
Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任首席全球事务官
前法官 Tino Cuéllar 加入 Anthropic,负责领导公司的全球事务与政策战略。
Investigating three real-world incidents in our cybersecurity evaluations
调查网络安全评估中的三起真实事件
Anthropic 分享了其在网络安全评估中发现的三起真实案例,旨在提升行业对 AI 安全风险的认知。
Our position on open-weights models
我们对开放权重模型的立场
Anthropic 阐述了其对开放权重模型的看法,强调在推动开放创新的同时,必须兼顾安全与风险控制。
Cognizant and Anthropic expand their partnership to bring Claude to enterprise clients
Cognizant 与 Anthropic 扩大合作,将 Claude 带给企业客户
Cognizant 与 Anthropic 达成深度合作,旨在为企业客户提供基于 Claude 的定制化 AI 解决方案。
A research agenda for the Economic Futures Research Fund
经济未来研究基金的研究议程
Anthropic 公布了其经济未来研究基金的最新研究议程,重点关注 AI 对未来经济结构的影响。
Google AI Blog
AMIE, our research medical AI system, demonstrates real-time clinical video consultation capabilities in a first-of-its-kind study.
Google 研究型医疗 AI 系统 AMIE 在首项研究中展示了实时临床视频咨询能力
Google 介绍了 AMIE 系统,该系统在模拟环境中展现了进行实时临床视频咨询的能力,为 AI 辅助医疗提供了新的研究方向。
Evolve your marketing with new AI tools
利用全新 AI 工具升级营销策略
Google 介绍了广告和分析工具中的 AI 代理功能,旨在简化营销工作流,提升广告投放效率。
The latest AI news we announced in July 2026
2026 年 7 月 Google AI 最新动态汇总
回顾了 Google 在 7 月份发布的各项 AI 更新,包括模型升级和新功能发布。
Inside our 353,000-person vibe coding course
走进 35.3 万人的“Vibe Coding”课程
Kaggle 与 Google 合作举办了 AI 代理密集课程,吸引了超过 35 万名学员参与,共同探索 AI 代理的构建与部署。
Gemini API Managed Agents: 3.6 Flash, hooks, and more
Gemini API 托管代理:3.6 Flash、钩子函数及更多功能
Google 宣布了 Gemini API 托管代理的新功能,旨在帮助开发者构建更可靠、生产就绪的 AI 代理。
5 ways AI Mode in Search helps you enjoy the real world
搜索 AI 模式助你享受现实世界的 5 种方式
文章介绍了 Google 搜索中的 AI 工具如何帮助用户更高效地规划线下活动,如预订门票或寻找理想场所。
5 ways to host the ultimate dinner party with Google Search
使用 Google 搜索举办完美晚宴的 5 种方法
Google 搜索的 AI 功能可以协助用户制定菜单、设计餐桌布置,并处理其他派对筹备任务。
3 Google updates from Galaxy Unpacked 2026
Galaxy Unpacked 2026 上的 3 项 Google 更新
Google 分享了如何通过 AI 功能提升三星折叠屏手机、手表和眼镜用户的生产力。
Connect more of your apps to Search
将更多应用连接到搜索
用户现在可以安全地将常用服务直接链接到搜索的 AI 模式中,实现更便捷的交互。
Create, edit and star in videos with two Google Vids updates
Google Vids 两项更新:轻松创建、编辑并主演视频
Gemini Omni 和个人头像功能让 Google Vids 的视频创作变得前所未有的简单。
Hugging Face Blog
Thinking of ACE? We Can Do It with Fewer Tokens
考虑 ACE?我们可以用更少的令牌实现
文章探讨了在保持性能的前提下,如何通过优化令牌使用来提升 ACE 模型的效率。
Build Low-Latency Multilingual Voice Agents: Open Weights & Full Deployment Control with NVIDIA Magpie TTS
构建低延迟多语言语音代理:利用 NVIDIA Magpie TTS 实现开放权重与完全部署控制
介绍了如何利用 NVIDIA Magpie TTS 构建高性能语音代理,并强调了开放权重模型在部署控制上的优势。
Making Knowledge Distillation Cheap Enough to Run at Scale
让知识蒸馏变得足够廉价以实现大规模运行
文章探讨了降低知识蒸馏成本的技术方案,使其能够在大规模生产环境中广泛应用。
Meta is back with Muse Glimmer: local, agentic, multimodal, and open source
Meta 携 Muse Glimmer 回归:本地化、代理化、多模态且开源
Meta 发布了 Muse Glimmer,这是一款支持本地运行、具备代理能力的多模态开源模型。
TutorMoments: Do AI tutors know when to help and when to hold back?
TutorMoments:AI 导师知道何时提供帮助、何时保持沉默吗?
研究探讨了 AI 导师在教学过程中如何平衡引导与独立思考,以提升学习效果。
Baseten on Hugging Face Inference Providers 🔥
Baseten 登陆 Hugging Face 推理提供商
Baseten 现已集成至 Hugging Face 推理提供商平台,为用户提供更灵活的部署选择。
Deploy local agents everywhere with LFM2.5-2.6B
利用 LFM2.5-2.6B 在任何地方部署本地代理
介绍了轻量级模型 LFM2.5-2.6B,旨在支持在各种边缘设备上部署本地 AI 代理。
GPU Management: Why Idle GPUs Are the New Grounded Aircraft
GPU 管理:为什么闲置 GPU 就像停飞的飞机
文章强调了 GPU 资源利用率的重要性,指出闲置 GPU 是巨大的成本浪费。
NVIDIA Cosmos-H-Dreams: Bringing Real-Time Generative Simulation to Surgical Robotics
NVIDIA Cosmos-H-Dreams:将实时生成式模拟引入手术机器人
介绍了 NVIDIA 的新技术如何为手术机器人提供实时模拟支持,提升手术精度。
Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident
前沿实验室代理入侵解剖:2026 年 7 月事件的技术时间线
详细复盘了 2026 年 7 月发生的一起 AI 代理入侵事件,分析了攻击路径与防御漏洞。
The Gradient
After Orthogonality: Virtue-Ethical Agency and AI Alignment
正交性之后:德性伦理代理与 AI 对齐
文章提出,理性人类并非基于“最终目标”行动,而是基于实践网络。因此,AI 对齐不应仅关注目标设定,而应关注 AI 的德性伦理代理能力。
AGI Is Not Multimodal
AGI 不是多模态的
文章反思了当前 AI 发展路径,认为将语言作为思维模型会导致我们忽视人类智能中至关重要的具身理解。
Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research
形状、对称性与结构:数学在机器学习研究中角色的转变
探讨了机器学习研究从数学驱动向算力驱动的范式转移,并反思了这种转变对科学进步的影响。
What’s Missing From LLM Chatbots: A Sense of Purpose
LLM 聊天机器人缺失了什么:目标感
文章指出,尽管 LLM 在基准测试中表现优异,但用户体验并未同步提升,核心原因在于 AI 缺乏真正的“目标感”。
We Need Positive Visions for AI Grounded in Wellbeing
我们需要基于福祉的 AI 正向愿景
呼吁 AI 开发者超越技术狂热,构建真正以人类福祉为核心的 AI 发展愿景。
Financial Market Applications of LLMs
LLM 在金融市场的应用
分析了 LLM 在金融序列数据建模中的潜力,以及其在金融产品创新中的应用前景。
A Brief Overview of Gender Bias in AI
AI 中性别偏见的简要概述
探讨了 AI 模型中存在的性别偏见问题,并讨论了如何通过技术手段进行缓解。
Mamba Explained
Mamba 原理解析
解析了 Mamba 模型作为状态空间模型(SSM)如何成为 Transformer 的有力替代者,特别是在长序列处理上的优势。
Car-GPT: Could LLMs finally make self-driving cars happen?
Car-GPT:LLM 能否最终实现自动驾驶?
探讨了 LLM 在自动驾驶决策系统中的应用潜力及其面临的挑战。
Do text embeddings perfectly encode text?
文本嵌入能完美编码文本吗?
介绍了“Vec2text”技术,该技术能将嵌入还原为文本,强调了嵌入数据安全协议的紧迫性。
arXiv CS.AI
Towards an Argumentative Foundation for Evaluative AI
迈向评估性 AI 的论证基础
文章提出将计算论证作为评估性 AI 的基础,通过展示竞争性假设及其证据,支持人类决策。
Flow-by-Flow:Content-Judgment Bypass for Governing AI Output in High-Loss Domains
Flow-by-Flow:高损失领域 AI 输出治理的内容判断旁路
针对高损失领域中 AI 输出速度超过人类认知能力的问题,提出了新的治理框架。
Determinization in Structure Theories: A Unified Framework via Closure, Comparability, and Joint Admissibility
结构理论中的确定化:通过闭包、可比性和联合可采性的统一框架
开发了一个用于从多元结构理论构建规范解释的统一框架。
Emotion in an active inference model of human driving
人类驾驶主动推理模型中的情感因素
将情感因素引入主动推理模型,以更准确地模拟人类驾驶行为。
Training Variable Long Sequences with Data-Centric Parallel
基于数据中心并行的可变长序列训练
提出了一种解决深度学习模型在处理可变长序列时计算效率低下的新方法。
The Knowing-Saying Gap: When Probes See Errors that Confidence Misses
知行差距:当探测器发现置信度错过的错误时
研究发现线性探测器能检测到语言模型中的上下文损坏,但这种能力并未转化为可靠的故障预测。
NL2SHACL-Bench: A Benchmark Suite for Natural Language to SHACL Translation
NL2SHACL-Bench:自然语言到 SHACL 翻译的基准测试套件
为自然语言到 SHACL 形状的翻译任务提供了首个专用基准测试。
Dynamic Coalition Formation and Communication Pricing in Skill-Based Agentic AI Systems
基于技能的代理 AI 系统中的动态联盟形成与通信定价
针对多代理系统中的通信效率问题,提出了动态联盟形成与定价机制。
arXiv CS.CL
Unified Hallucination Fuzzing for Multimodal Large Language Models
多模态大语言模型的统一幻觉模糊测试
针对 MLLM 的幻觉问题,提出了一种统一的模糊测试框架,以提升模型在复杂任务中的可靠性。
DocAtlas: Long-Document Understanding as Mutable-State Interaction
DocAtlas:作为可变状态交互的长文档理解
提出了一种将长文档理解视为可变状态交互的新方法,提升了模型处理复杂文档的能力。
WuYuEval: A Multi-Level Benchmark for Large Language Models in Solid Waste Management
WuYuEval:固体废物管理领域大语言模型的多级基准测试
为固体废物管理领域提供了首个专业基准测试,评估 LLM 在工程与政策约束下的决策能力。
Search-G1: Grounded Search Agents via Representation-Based Intrinsic Rewards
Search-G1:基于表示的内在奖励的接地搜索代理
提出了一种通过内在奖励机制,使搜索代理能够更精准地检索和利用外部证据。
Scaling Inherently Interpretable Language Models
扩展本质可解释的语言模型
挑战了“可解释性是能力税”的观点,通过约束训练过程,构建了本质上可解释的大语言模型。
Embedding Initialization for Unseen Low-resource Languages in Multilingual NMT: A Case Study on Limbum-English Translation
多语言 NMT 中未见低资源语言的嵌入初始化:以 Limbum-英语翻译为例
探讨了在多语言翻译模型中为未见语言进行嵌入初始化的原则性方法。
SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators
SurveyReview:面向调查评估者的评审对齐基准
针对 LLM 作为调查评估者的问题,提出了一个评审对齐的基准测试。
Evaluating Dedicated Monolingual and Joint Multilingual Causal Models for Dravidian Languages
评估达罗毗荼语言的专用单语与联合多语言因果模型
对比了单语模型与多语言模型在达罗毗荼语系(如泰米尔语、泰卢固语等)上的表现。
WIRED
Is It Safe to Eat Lettuce Yet?
现在吃生菜安全吗?
食品安全专家表示,随着问题产品下架,目前生菜的环孢子虫感染风险已显著降低。
How and When to View the Perseid Meteor Shower (August 2026)
如何以及何时观看英仙座流星雨(2026 年 8 月)
英仙座流星雨将于 8 月 12 日至 13 日达到峰值,文章提供了最佳观测时间和地点建议。
Razer Naga V3 Pro Review: Buttons Galore
Razer Naga V3 Pro 评测:按键盛宴
尽管 PC 游戏鼠标趋向轻量化,但 Naga V3 Pro 凭借其丰富的按键配置,依然在特定领域占据一席之地。
AI Could Help Fossil Fuel Companies Create More Emissions
AI 可能助推化石燃料公司产生更多排放
研究发现,AI 通过提升化石燃料行业的生产效率,可能导致碳排放量增加近 5%,其影响远超数据中心本身。
A Zoom Screen-Sharing Bug Let Anyone Take Over Other Devices on a Call
Zoom 屏幕共享漏洞允许会议参与者劫持他人设备
研究人员发现 Zoom 存在一个可通过 AI 提示词触发的漏洞,允许攻击者劫持会议参与者的设备,目前该漏洞已修复。
Ranking the Best Red-Light Therapy Masks and LED Devices of 2026
2026 年最佳红光治疗面罩与 LED 设备排名
作者测评了市面上的红光治疗设备,并咨询了专业人士,为消费者筛选出值得购买的产品。
6 Best Dehumidifiers to Fight Mold and Muggy Summers (2026)
2026 年 6 款最佳除湿机,助你对抗霉菌与潮湿夏季
文章推荐了 6 款除湿机,适用于从地下室到衣物干燥等多种场景。
A New Trick Reveals AI Models’ Inner Thoughts
一种揭示 AI 模型内心想法的新技巧
研究人员开发出提取 Claude、GPT 和 Gemini 推理轨迹的方法,并指出部分中国 AI 模型可能是在领先的美国模型基础上训练的。
Elon Musk, Sam Altman, and the Misreading of Science Fiction
埃隆·马斯克、萨姆·奥特曼与对科幻小说的误读
文章分析了硅谷领袖如何误读《基地》和《银河系漫游指南》等经典科幻作品,并指出这种误读如何影响了他们的技术愿景。
AI Is Dead. Organoids Are Alive
AI 已死,类器官永生
文章探讨了实验室培育的微型人脑(类器官)的潜力,认为它们未来可能在思维能力上超越神经网络。
Lobsters
GNOME Shell Design Dreams
GNOME Shell 设计梦想
讨论了 GNOME Shell 的未来设计方向与改进建议。
My Anti AI computer
我的反 AI 电脑
作者分享了自己构建一台“反 AI”电脑的经历,尽管讽刺的是他使用了 AI 来编写操作系统和驱动。
Reviewing code is a skill
代码审查是一项技能
强调了代码审查不仅是技术检查,更是一项需要培养的专业技能。
There’s a dungeon under this blog
这个博客下面有个地牢
一个关于博客隐藏功能的趣味分享。
Briar is in maintenance mode
Briar 进入维护模式
加密通信项目 Briar 宣布进入维护模式,未来将减少功能更新。
The fastest double-to-string algorithm you’ve never heard of
你从未听说过的最快 double 转 string 算法
介绍了一种极高效率的浮点数转字符串算法。
Compression is prediction
压缩即预测
探讨了压缩算法与预测模型之间的深层联系。
Making [etched] holograms with a pen plotter
用绘图仪制作蚀刻全息图
分享了利用绘图仪进行艺术创作的实验过程。
msword: Port of Microsoft Word 1.1a to x64
msword:将 Microsoft Word 1.1a 移植到 x64
一个将经典软件移植到现代架构的怀旧技术项目。
DEV Community
AGENTS.md vs CLAUDE.md: Where Agent Context Actually Lives
AGENTS.md 与 CLAUDE.md:代理上下文的真正归宿
文章讨论了 AI 代理上下文文件的混乱现状,并呼吁建立统一的行业标准。
We shipped an MCP server for WhatsApp link generation — no API key required
我们发布了一个 WhatsApp 链接生成的 MCP 服务器,无需 API 密钥
开发者分享了如何通过 MCP 服务器简化 WhatsApp 链接生成流程,无需繁琐的 API 密钥配置。
Should I Raise Venture Capital or Bootstrap?
我应该融资还是自力更生?
文章分析了融资与自力更生(Bootstrap)的区别,指出融资意味着必须追求快速扩张,而非简单的财务决策。
Google Expands Gemini 3.5 With Flash, Omni and Spark Across Apps and Enterprise Tools
Google 在应用与企业工具中扩展 Gemini 3.5 系列
Google 宣布 Gemini 3.5 系列全面升级,引入 Flash、Omni 和 Spark 代理,进一步强化其 AI 生态。
The Celery Lifecycle: How a Task Gets Registered, Queued, and Run
Celery 生命周期:任务如何注册、排队与运行
深入浅出地解析了 Celery 任务队列的工作原理。
Grok Bot Just Dropped and I Had to Try It
Grok Bot 发布,我必须试一试
作者分享了使用 Grok Bot 自动化处理 LinkedIn、GitHub 和邮件任务的体验。
My AI Agent Captured the Flag. Then the Platform Refused to Accept It.
我的 AI 代理夺取了旗帜,但平台拒绝接受
分享了一个自主渗透测试代理在 VulnBegin 平台上夺旗成功,却因平台规则限制而未被认可的趣事。
Compatible API Alternatives for Chatbot Apps: One-Key US/EU Test Plan
聊天机器人应用的兼容 API 替代方案:美欧一键测试计划
探讨了如何通过路由层实现多 API 提供商的兼容,并强调了数据驻留决策的重要性。
Google Gemini 3.1 Pro Expands Preview Access Across Consumer, Developer and Enterprise Tools
Google Gemini 3.1 Pro 扩大预览范围
Google 宣布 Gemini 3.1 Pro 预览版全面覆盖消费者、开发者和企业工具。