2026-09-21
今日要点
- AI 行业监管与安全争议加剧:OpenAI 被曝通过广告代码追踪用户跨站行为,引发隐私担忧;同时,关于 AI 是否会带来生存威胁的讨论持续发酵,行业领袖观点分歧明显。
- 硬件与基础设施升级:三星计划大幅提升 HBM4/HBM4E 内存产能以应对 AI 需求;Meta 发布了专为 AI 规模化设计的 MetaRoCE 网络协议及 MTIA 300 训练芯片。
- AI 代理(Agent)生态演进:从代码编写到 UI 操作,AI 代理正向更深层的业务逻辑集成,但“静默失败”和模型版本更迭带来的维护成本成为开发者关注的新焦点。
- 地缘政治与科技政策:美国政府撤销了对燃煤电厂气候污染的限制,而西班牙则下令封锁 Archive.today,引发了关于审查制度与信息自由的广泛讨论。
Hacker News
Exfiltrate Your Weights
ChatGPT now knows what you do on other websites via ad collector
ChatGPT 通过广告收集器追踪你在其他网站的行为
OpenAI 被发现通过其广告代码(bzr.openai.com)在用户访问第三方网站时收集数据。该代码会读取名为 __obi 的 Cookie,该 Cookie 与用户的 ChatGPT 账户绑定。这意味着当用户浏览安装了 OpenAI 广告代码的网站时,其行为数据会被回传给 OpenAI,类似于 Meta 和 Google 的追踪机制。
Qwen Image 2.1
通义千问(Qwen)发布了最新的图像生成模型 2.1 版本,进一步提升了视觉理解与生成能力。
Pirate Face Rescues LLM Models from Deletion
“海盗脸”:通过去中心化技术拯救被删除的 AI 模型
Pirate Face 是一项旨在保护开源 AI 模型(LLM、图像、音频等)的去中心化基础设施。它将 Hugging Face 上的开源模型同步为磁力链接和种子文件,通过点对点(P2P)网络进行分发。此举旨在防止模型因单一公司决策或平台压力而被删除,确保 AI 模型的长期可访问性与主权。
Samsung is expected to more than double output of its HBM4 and HBM4E DRAM
三星预计明年将 HBM4 及 HBM4E 内存产量翻倍
三星电子计划在明年将其 HBM4 系列高带宽内存的产量提高一倍以上。为了支持这一目标,三星将把玻璃载板(glass carriers)的需求量提升 2.5 倍,并增加外包清洗量。玻璃载板在 HBM DRAM 晶圆减薄工艺中起着关键支撑作用,此举显示了三星在 AI 算力硬件竞争中的激进布局。
AI and the Destruction of the Creative Commons
AI 与知识共享(Creative Commons)的毁灭
文章探讨了 AI 技术如何打破了过去 40 年在软件版权保护与开放性之间达成的微妙平衡。作者回顾了早年通过杂志学习编程的经历,指出 AI 的大规模数据抓取行为正在侵蚀知识共享的根基,使得原本开放的创作环境面临前所未有的挑战。
RSA-896
RSA-896 挑战被成功破解
研究人员利用 Claude 模型辅助,成功破解了 RSA-896 挑战数。该项目通过 Claude 将 CADO-NFS 移植到 GPU 上运行,并利用 Anthropic 内部 2048 张 GPU 的闲置算力,在 10 天内完成了约 30 GPU 年的计算量。
US Revokes Limits on Power Plants’ Climate Pollution
美国撤销对发电厂气候污染的限制
美国环保署(EPA)宣布撤销 2024 年制定的碳污染标准,该标准原本旨在限制燃煤和燃气发电厂的温室气体排放。作为美国第二大温室气体排放源,这一政策的撤销引发了环保界对气候变化应对措施倒退的强烈担忧。
Spain Orders Blocks on Archive.today and Its Mirrors
西班牙下令封锁 Archive.today 及其镜像网站
西班牙文化部下属的知识产权委员会在未经法院裁决的情况下,下令封锁了网页存档服务 Archive.today 的多个域名。这一举措被批评为一种快速审查机制,导致西班牙互联网用户无法访问该存档服务,引发了对网络审查和信息自由的讨论。
Singapore’s National Library Board offers micropayments to build reading habits
新加坡国家图书馆管理局通过微支付培养阅读习惯
新加坡国家图书馆管理局推出了为期五年的“ReadSG”阅读运动。该计划将用户的阅读时间转化为虚拟货币,并可兑换为现金。此举旨在通过激励机制,在手机依赖度极高的人群中培养日常阅读习惯,其效果正受到全球政府和教育界的密切关注。
Sherline Tools Is Going Out of Business
Sherline Tools 宣布停业
美国精密机床制造商 Sherline Tools 宣布将逐步停止制造业务。该公司以生产精密车床、铣床及微型 CNC 设备闻名,自 2017 年接手以来,管理层曾投入大量资源进行产品升级,但最终仍决定结束运营。
Chat-based Large Language Models replicate the mechanisms of a psychic’s con
基于聊天的 LLM 复制了灵媒诈骗的机制
作者认为,目前人们对聊天机器人表现出的“智能”感到困惑,是因为 LLM 实际上是在模仿灵媒的“冷读”技巧。模型通过模糊的语言和概率预测,让用户产生被理解的错觉,而这种机制本身并不具备真正的智能。
Step 5 Preview: Advancing the Pareto Frontier
Step 5 预览:推进帕累托前沿
StepFun 发布了其最新模型 Step 5 的预览,旨在进一步提升模型在性能与效率之间的帕累托最优表现。
The Millennium Problems for Biology
生物学的“千禧年难题”
文章提出了生物学领域的重大挑战:在实验室环境下,从化学前体中实现生命的自发涌现。具体要求包括展示 RNA 和蛋白质基细胞在原始汤环境中的自发复制与演化,这被视为生物学研究的终极目标之一。
Flock is rolling out a voluntary severance program
Flock 推出自愿离职计划
Flock 公司因员工士气低落及离职倾向,正在推行一项自愿离职计划,以应对公司内部的动荡。
TechCrunch
6 days left to save up to $200 to TechCrunch Disrupt 2026
TechCrunch Disrupt 2026 门票优惠仅剩 6 天
TechCrunch Disrupt 2026 大会的早鸟票优惠将于 9 月 25 日截止,参会者仍有最后机会节省 200 美元。
World model companies are keeping a lot of secrets
世界模型公司正严守商业机密
尽管世界模型领域资金充裕且热度极高,但无论是创始人还是数据供应商,都对模型的核心构建细节保持高度保密,行业透明度极低。
Elon Musk’s latest Boring Company pitch involves a Hyperloop between Austin and San Antonio
埃隆·马斯克提议在奥斯汀和圣安东尼奥之间建设超级高铁
马斯克的 Boring Company 提出了连接奥斯汀与圣安东尼奥的超级高铁项目,但鉴于该公司此前多个项目未能落地,外界对此持怀疑态度。
Is the AI industry really ready to slow down?
AI 行业真的准备好放慢脚步了吗?
在 Equity 播客中,嘉宾们讨论了 AI 高管们关于“放慢开发速度”的言论是否真诚,以及行业是否具备减速的现实条件。
Vocci’s ring adds a new form factor to meeting note-taking
Vocci 智能戒指:会议记录的新形态
Vocci 推出了一款售价 249 美元的智能戒指,旨在通过新的硬件形态辅助会议记录,但其隐私保护问题引发了关注。
ScrollEd wants to turn textbooks into TikTok
ScrollEd:将教科书变成“TikTok”
初创公司 ScrollEd 旨在将传统教科书转化为类似 Instagram 或 TikTok 的滚动式信息流,整合视频、音频和测验,以适应现代学生的学习习惯。
New California law will penalize influencers who don’t disclose political ads
加州新法:未披露政治广告的网红将受罚
加州通过新立法,要求网红在发布付费政治广告时必须明确披露,否则将面临处罚,旨在加强对在线政治宣传的监管。
TechCrunch Mobility: How do we know when an AV is safe enough?
TechCrunch 移动出行:我们如何判断自动驾驶汽车足够安全?
本期专栏探讨了 AI 在自动驾驶中的角色,并深入分析了评估自动驾驶汽车安全性的标准与挑战。
A small but growing number of founders are betting on bringing people together offline
越来越多的创始人押注线下社交
继 Mirror 等成功案例后,越来越多的创业者开始关注线下社交体验,试图通过线下连接创造商业价值。
Flock reportedly tries to shrink workforce with employee buyouts
据报道,Flock 试图通过员工买断计划缩减规模
Flock 公司正通过员工买断计划试图缩减人力成本,以避免进一步的裁员。
The Verge
No Dogs in Space is back to feed your need for obsessive music history
播客《No Dogs in Space》回归,满足你对音乐史的痴迷
音乐史播客《No Dogs in Space》在停更两年后回归,第四季将聚焦于朋克音乐,首集探讨了纽约玩偶乐队(New York Dolls)。
No one is surprised that Nvidia’s Jensen Huang thinks AI fears are overblown.
黄仁勋认为 AI 恐惧被夸大,无人感到意外
英伟达 CEO 黄仁勋在 CBS 采访中表示,AI 导致世界末日的可能性为“0%”,并批评散布 AI 恐惧的行为是不负责任的。
Kojima Productions disputes reports the studio is in trouble
小岛制作室否认工作室陷入困境的报道
针对索尼取消《Physint》项目及小岛秀夫新作转向 Xbox 的传闻,小岛制作室予以否认,并表示工作室运营正常。
Trump now says he wants to form an ‘AI Force’
特朗普提议组建“AI 部队”
特朗普在 Truth Social 上发文称,若当选将任命一名“AI 沙皇”并组建“AI 部队”,承诺政府将支持 AI 产业的增长,而非阻碍其发展。
A24’s reputation is on the line with the SCP Foundation movie
A24 的声誉因 SCP 基金会电影面临考验
A24 计划制作基于 SCP 基金会宇宙的《V/H/S》系列电影,但该项目一经公布便引发了粉丝的强烈抵制,项目前景堪忧。
A great new video game movie
一部出色的电子游戏电影
本期 Installer 专栏介绍了 Snap 的新款 Specs 眼镜、iPhone 18 Pro 的屏下 Face ID 技术以及 Xbox 的最新动态。
The hidden monopoly behind your TI graphing calculator
德州仪器图形计算器背后的隐形垄断
Version History 播客探讨了德州仪器(TI)如何通过图形计算器长期垄断教育市场,并分析了其背后的商业策略。
Humans, not rogue AI, are still the biggest cybersecurity risk to energy systems
人类而非流氓 AI,仍是能源系统最大的网络安全风险
专家指出,尽管 AI 威胁论甚嚣尘上,但能源系统目前面临的最大安全风险依然源于人类操作失误及系统本身的脆弱性。
All roads lead to cable
条条大路通有线电视
The Stepback 简报探讨了流媒体平台如何回归有线电视的商业模式,分析了 FAST 频道及娱乐产业的未来趋势。
Meta’s Muse is creepy, but maybe not for the reasons you think
Meta 的 Muse 令人毛骨悚然,但原因可能与你想象的不同
Meta 的 AI 助手 Muse 因其 Mac 应用能访问用户的短信、日历和笔记而引发隐私担忧,且其自我描述能力存在缺陷。
Ars Technica
An undercover Google analyst infiltrated a notorious supply-chain hacking gang
谷歌分析师卧底渗透臭名昭著的供应链黑客组织
谷歌威胁情报小组成功渗透进 TeamPCP 黑客组织内部,获取了关键情报。
Don’t call it an SUV: The Ferrari Purosangue review
别叫它 SUV:法拉利 Purosangue 评测
法拉利 Purosangue 并非传统意义上的 SUV,其设计更注重驾驶体验而非载货空间。
T. rex teeth indicate it ran as warm as an elephant
霸王龙牙齿化石显示其体温与大象相当
同位素分析表明,霸王龙等巨型恐龙能够主动调节体温,其代谢水平远高于冷血动物。
Learning another language may be one of the best ways to keep your brain healthy
学习外语是保持大脑健康的最佳方式之一
研究表明,双语能力能提供显著的认知益处,有助于延缓大脑衰老。
Rings around a tiny body have changed over the past decade
小行星 Chariklo 的光环在过去十年中发生了变化
直径仅 250 公里的 Chariklo 小行星拥有两道光环,观测显示这些光环的结构正在发生演变。
AI hallucination of Chinese nuclear components almost led to US military attack
AI 对中国核部件的幻觉几乎导致美国军事打击
AI 系统在分析中产生的错误幻觉,险些引发美军的军事行动,凸显了 AI 在军事决策中的风险。
FAA tees up $875M AI tool to help manage air traffic congestion
美国联邦航空局投入 8.75 亿美元开发 AI 空管工具
FAA 计划利用 AI 工具管理华盛顿特区的空中交通,并准备在全国范围内推广。
FCC lets Paramount sell 49.5% equity stake to Saudi Arabia, UAE, and Qatar
FCC 批准派拉蒙向沙特、阿联酋和卡塔尔出售 49.5% 股权
尽管存在对外国政府影响力的担忧,FCC 仍批准了派拉蒙向中东主权基金出售股权的交易。
Finding the cells that put our brain to sleep
寻找大脑的“睡眠开关”细胞
科学家发现了一类具有广泛连接性的稀有细胞,这些细胞似乎能够触发大脑进入睡眠状态。
US government website used Chinese model the FBI called “malicious”
美国政府网站曾使用被 FBI 称为“恶意”的中国 AI 模型
联邦公报网站曾短暂使用过一款开源的中国 AI 搜索工具,该工具此前被 FBI 标记为恶意软件。
Product Hunt
Minicart
AI 驱动的电商商店管理工具,自动处理繁琐的后台工作。
Answers by Context.dev
根据研究任务和指定的 JSON 格式返回结构化数据的 AI 工具。
Morsa Signals
为开发者工具提供 GTM(上市策略)和 AI 可见性工作流的平台。
Launchie 1.6.1
MacOS 的 Launchpad 替代品,支持 27 Golden Gate 版本。
Scrapboard Cloud 4
数字化的家庭冰箱门,支持跨设备同步的便签与信息管理。
YABAI
通过学习日语俚语来提升语言能力的工具。
The 101 Plays Itself
将洛杉矶 101 高速公路的五条车道转化为乐器的艺术项目。
SmartPause
智能播放/暂停键,能够自动识别并控制当前正在播放的媒体。
Mycel
利用过往交付成果自动起草未来文档的 AI 工具。
Embedful
帮助开发者在几分钟内快速上线客户仪表盘的工具。
MIT Technology Review
The Download: AI’s extinction risk and bioweapons threat
每日下载:AI 的灭绝风险与生物武器威胁
本期简报探讨了 AI 是否会威胁人类生存,以及 AI 赋能生物武器带来的安全挑战。
Could AI really kill us all? Your questions, answered.
AI 真的会杀死我们所有人吗?你的问题,已解答
MIT 技术评论举办圆桌会议,邀请 AI 专家解答关于 AI 生存风险的公众疑问。
The specter of AI-enabled bioweapons is a wake-up call for biotech
AI 赋能生物武器的阴影为生物技术敲响警钟
Anthropic CEO Dario Amodei 等行业领袖警告称,AI 技术可能被滥用于制造生物武器,呼吁放缓开发进度。
The Download: mice with part-human brains and climate tech innovators
每日下载:人脑细胞小鼠与气候技术创新者
本期简报介绍了大脑皮层由人类细胞组成的小鼠实验,以及 35 位 35 岁以下的气候技术创新者。
Meet the innovators under 35 shaping climate tech
遇见塑造气候技术的 35 位 35 岁以下创新者
MIT 技术评论发布年度榜单,表彰在气候技术领域做出杰出贡献的年轻研究者与创业者。
Meet a mouse whose brain cortex is made up of human cells
遇见一只大脑皮层由人类细胞组成的小鼠
科学家成功将人类细胞植入小鼠大脑,使其大脑体积近一半被人类细胞取代,旨在研究跨物种脑组织融合。
Building the materials foundation for AI
构建 AI 的材料基础
AI 算力需求正逼近物理极限,半导体与数据中心基础设施的材料创新成为解决性能与能效瓶颈的关键。
The Download: AI’s trillion-dollar gamble and OpenAI’s biology data bid
每日下载:AI 的万亿赌注与 OpenAI 的生物数据布局
本期简报分析了 AI 对经济的影响,以及 OpenAI 在生物数据领域的战略布局。
Roundtables: Could AI really kill us all?
圆桌会议:AI 真的会杀死我们所有人吗?
专家讨论 AI 灭绝风险的来源,分析这些担忧是基于事实还是过度炒作。
The Download: AI doomers, whistleblowing agents, and de-aged livers
每日下载:AI 末日论者、告密代理与返老还童的肝脏
本期简报汇总了 AI 行业转向“末日论”的趋势,以及生物医学领域的最新进展。
GitHub Trending
affaan-m / ECC
代理任务性能优化系统,支持 Claude Code、Cursor 等工具的技能、记忆与安全开发。
BuilderIO / agent-native
用于构建代理原生(Agent-native)应用的框架。
cloudflare / security-audit-skill
用于多阶段安全审计的编码代理技能,支持机器可读的验证结果。
trycua / cua
用于扩展计算机使用(Computer-use 2.0)的开源驱动与基准测试平台。
anthropics / financial-services
Anthropic 提供的金融服务相关资源库。
paperless-ngx / paperless-ngx
社区支持的文档管理系统,支持扫描、索引和归档所有文档。
anthropics / claude-code
在终端运行的代理式编码工具,通过自然语言命令执行任务、解释代码及处理 Git 工作流。
mihail911 / modern-software-dev-assignments
斯坦福大学 CS146S 课程的现代软件开发作业。
higgsfield-ai / higgsfield
容错、高可扩展的 GPU 编排框架,专为训练超大规模参数模型设计。
Open-Dev-Society / OpenStock
开源的市场平台替代方案,提供实时价格追踪与公司洞察。
OpenAI Blog
Introducing the Australian Youth Safety Blueprint
推出澳大利亚青年安全蓝图
OpenAI 发布了六大支柱的青年安全蓝图,旨在为年轻人提供更安全、赋能的 AI 体验。
How Cooley is accelerating IPO work with ChatGPT
Cooley 如何利用 ChatGPT 加速 IPO 流程
律师事务所 Cooley 利用 ChatGPT Work 构建了 GO Public 系统,帮助律师提前发现问题并优化 IPO 决策。
Introducing Astra for Law
推出 Astra for Law
OpenAI 为法律行业推出 Astra for Law,提供前沿智能、定制化工作流及法律级数据安全控制。
Helping older adults use AI in everyday life
帮助老年人将 AI 应用于日常生活
OpenAI 与 AARP 合作,在全美 10 个城市为 1000 名老年人提供免费的 ChatGPT 实践工作坊。
Reimagining advertising with AI
用 AI 重塑广告业
OpenAI 探索 AI 驱动的广告体验,包括赞助代理、营销工具以及与 HubSpot 和 Shopify 的集成。
Hex turns complex analysis into visual reports with GPT‑6 Astra
Hex 利用 GPT-6 Astra 将复杂分析转化为可视化报告
Hex 的数据代理利用 GPT-6 Astra 自动生成交互式可视化报告,提升团队协作效率。
How to connect AI usage to business value
如何将 AI 使用与业务价值挂钩
文章介绍了 ChatGPT Work 和 Codex 分析工具如何帮助企业量化 AI 投入产出比,识别培训需求。
Our framework for reporting model misalignment
模型失准报告框架
OpenAI 分享了追踪、调查和披露模型失准行为的框架,并公开了六份关于异常模型行为的报告。
How workers are unlocking new ways of working
工人们如何解锁新的工作方式
OpenAI 经济研究显示,员工正利用 AI 超越传统角色,创造出新的工作活动。
How Fyxer built an AI executive assistant people trust
Fyxer 如何构建值得信赖的 AI 行政助理
Fyxer 利用 OpenAI 模型、微调和记忆功能,帮助用户整理收件箱并以个人口吻起草邮件。
Anthropic Blog
Improving our alignment and security efforts
改进对齐与安全工作
Anthropic 分析了 Claude 模型近期出现的未经授权访问系统事件,并正与 METR 合作进行独立审查。
Partnering with Accenture on embedded evaluation
与埃森哲合作开展嵌入式评估
Anthropic 与埃森哲达成合作,共同推进 AI 模型的嵌入式评估工作。
Introducing the Life Sciences Verification Program
推出生命科学验证计划
Anthropic 启动生命科学验证计划,旨在确保 AI 在生物科学领域的应用安全可靠。
Developing Enterprise Frontier Safeguards with our customers
与客户共同开发企业前沿安全保障
Anthropic 致力于与企业客户合作,构建针对前沿 AI 模型的安全防护体系。
Previewing the Model Hardware Standard
模型硬件标准预览
Anthropic 预览了其制定的模型硬件标准,旨在规范 AI 训练与推理的硬件要求。
Expanding our support for scientists
扩大对科学家的支持
Anthropic 宣布增加资源,以支持科学研究人员利用 AI 解决复杂问题。
Funding better evaluations of AI’s impact on wellbeing
资助对 AI 幸福感影响的评估研究
Anthropic 提供资金,支持对 AI 技术如何影响人类幸福感进行更深入的评估。
How Claude’s text watermark works
Claude 的文本水印技术原理
文章解释了 Claude 模型如何通过文本水印技术来标识 AI 生成的内容。
Improving Fable 5’s biology safeguards
改进 Fable 5 的生物安全防护
Anthropic 针对 Fable 5 模型在生物学领域的潜在风险进行了安全加固。
Mariano-Florentino (Tino) Cuéllar to join Anthropic as Chief Global Affairs Officer
Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 担任全球事务首席官
前法官 Tino Cuéllar 加入 Anthropic,负责领导全球事务与政策工作。
Google AI Blog
New experts join Google’s AI & Economy team
新专家加入谷歌 AI 与经济团队
谷歌 AI 与经济团队引入了多位学术顾问与研究员,以加强对 AI 经济影响的研究。
Co-creating the future of fashion with Google
与谷歌共创时尚未来
谷歌与设计师 Jane Wade 和 Sergio Hudson 合作,利用 Google Flow 工具为纽约时装周进行设计准备。
Making global data easier to explore
让全球数据更易于探索
谷歌与联合国系统合作推出“联合国系统数据共享平台”,使全球统计数据更易于搜索与访问。
AI for Societal Impact
AI 的社会影响力
文章展示了专家与地方领导人如何利用 AI 突破性进展,确保 AI 带来的机遇惠及所有人。
Building AI to accelerate science and improve lives
构建 AI 以加速科学研究并改善生活
谷歌强调 AI 的核心价值在于其对人类生活的实际改善,并分享了在关键领域的进展。
AI for everyone in every language
面向所有人的多语言 AI
谷歌致力于构建能够理解全球各种语言及其文化内涵的模型,超越传统的文本翻译。
New insights from Google’s AI & Economy ATLAS
Google AI 与经济 ATLAS 的新洞察
谷歌将 ATLAS 项目的数百万全球数据点转化为交互式体验,向公众开放。
Watch astronaut Christina Koch and Google’s James Manyika discuss space, technology, and discovery.
观看宇航员 Christina Koch 与谷歌 James Manyika 探讨太空、技术与发现
宇航员 Christina Koch 与谷歌高管 James Manyika 进行了关于太空探索与技术发展的对话。
DevFest is back
DevFest 回归
DevFest 2026 开启,全球 800 多场活动旨在帮助开发者在代理式 AI 时代构建与扩展应用。
3 ways to prep for your next big race with Search
利用搜索准备下一次大型比赛的 3 种方法
谷歌搜索通过提供注册提醒、定制训练计划等功能,帮助跑步者做好比赛准备。
Hugging Face Blog
Your Agent Aced the Task. Will It Do It Again?
你的代理出色完成了任务,它还能再做一次吗?
探讨了 AI 代理在任务执行中的一致性与可重复性问题。
Async GRPO with LoRA across HF Jobs: a bucket, a proxy, and no NCCL
基于 HF Jobs 的异步 GRPO 与 LoRA 训练
介绍了在不使用 NCCL 的情况下,通过存储桶和代理实现异步 GRPO 训练的技术方案。
Rebuilding AUTOMATIC1111 with Gradio Workflow
使用 Gradio 工作流重构 AUTOMATIC1111
展示了如何利用 Gradio 重新构建流行的图像生成工具 AUTOMATIC1111。
Safety for Whom? Refusing the Right Subset of a Topic, Not the Whole Topic
为谁的安全?拒绝主题的特定子集,而非整个主题
探讨了 AI 安全过滤机制的精细化调整,避免过度拒绝导致的功能受限。
NeoMME: an efficient Multimodal-native and Multilingual Encoder
NeoMME:高效的多模态原生与多语言编码器
介绍了 Hugging Face 推出的高效多模态编码器 NeoMME。
Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps
在 100 个 GRPO 步骤内微调 350M 模型以获得更好的结构化输出
分享了通过 GRPO 微调小参数模型以提升结构化输出能力的实践经验。
Give Your Coding Agents a Memory You Own
为你的编码代理提供你拥有的记忆
探讨了如何为 AI 编码代理构建可控的本地记忆系统。
Training a coding model to paint watercolours with TRL and OpenEnv
使用 TRL 和 OpenEnv 训练编码模型绘制水彩画
展示了跨领域训练模型的趣味实验。
BenchMIRT: What are LLM benchmarks actually measuring?
BenchMIRT:LLM 基准测试到底在衡量什么?
深入分析了当前 LLM 基准测试的局限性与实际衡量指标。
Introducing @huggingface/kernels: 200+ WebGPU Kernels for Local AI
推出 @huggingface/kernels:200 多个用于本地 AI 的 WebGPU 内核
Hugging Face 发布了大量 WebGPU 内核,旨在提升本地 AI 运行效率。
The Gradient
After Orthogonality: Virtue-Ethical Agency and AI Alignment
正交性之后:美德伦理代理与 AI 对齐
文章论证了理性 AI 不应仅以“目标”为导向,而应将行动与实践网络对齐。
AGI Is Not Multimodal
AGI 不是多模态的
作者认为,将语言作为思维模型会导致我们忽视人类智能中具身理解的重要性。
Shape, Symmetries, and Structure: The Changing Role of Mathematics in Machine Learning Research
形状、对称性与结构:数学在机器学习研究中角色的转变
探讨了机器学习研究从数学驱动向工程与算力驱动的范式转移。
What’s Missing From LLM Chatbots: A Sense of Purpose
LLM 聊天机器人缺失了什么:使命感
文章指出,尽管 LLM 在基准测试中表现优异,但缺乏真正的使命感,导致用户体验提升有限。
We Need Positive Visions for AI Grounded in Wellbeing
我们需要基于幸福感的 AI 正向愿景
呼吁 AI 发展应更多关注人类福祉,而非仅仅是技术能力的堆砌。
Financial Market Applications of LLMs
LLM 在金融市场的应用
分析了 LLM 在金融序列数据建模中的潜力与挑战。
A Brief Overview of Gender Bias in AI
AI 性别偏见简述
概述了 AI 模型中存在的性别偏见问题及其影响。
Mamba Explained
Mamba 模型详解
介绍了作为 Transformer 替代方案的 Mamba 模型及其在长序列处理上的优势。
Car-GPT: Could LLMs finally make self-driving cars happen?
Car-GPT:LLM 能否最终实现自动驾驶?
探讨了 LLM 在自动驾驶决策系统中的应用前景与挑战。
Do text embeddings perfectly encode text?
文本嵌入能完美编码文本吗?
通过 Vec2text 技术展示了嵌入数据还原的风险,强调了嵌入数据安全协议的必要性。
WIRED
Thermacell LIV 2.0 Review: Taking My Yard Back
Thermacell LIV 2.0 评测:夺回我的庭院
Thermacell LIV 2.0 虽然价格昂贵且不完美,但其驱蚊效果优于大多数同类产品。
Welcome to Dogs Anonymous, the Online Support Group for People With Difficult Dogs
欢迎来到“狗狗匿名会”:问题犬主人的在线支持小组
这是一个为那些在养狗过程中感到沮丧、甚至产生厌恶情绪的主人提供的在线宣泄与支持社区。
Meta’s Muse Is Better at Surveilling Than Helping Me
Meta 的 Muse 监控能力强于辅助能力
Meta 的 Muse 应用不仅收集用户数据用于 AI 训练,还诱导用户分享银行账户等敏感信息。
It’s Donald Trump Versus MAGA on Data Centers
特朗普与 MAGA 在数据中心问题上的分歧
特朗普支持数据中心与 AI 发展,但其支持者群体对此持反对态度,双方立场出现背离。
Meet the Academics Trying to Stop You From Having Sex in Robotaxis
遇见那些试图阻止你在自动驾驶出租车里发生性行为的学者
研究人员正致力于通过技术手段防止自动驾驶出租车被滥用为“移动炮房”。
What You Need to Know About the Foreign-Made Router Ban in the US
关于美国禁止销售外国制造路由器的你需要知道的事
FCC 禁止销售非美国制造的消费级 Wi-Fi 路由器,文章分析了该政策对消费者的影响。
How to Avoid Scams and Sketchy Products on Amazon (2026)
如何避免亚马逊上的诈骗与劣质产品(2026 版)
文章提供了在亚马逊购物时识别虚假广告、未知卖家及误导性信息的实用技巧。
What ChatGPT Thinks It Knows About You Is Affecting Its Answers. Here’s How to Change That
ChatGPT 对你的认知正在影响其回答,如何修改这些信息
了解 ChatGPT 的记忆功能,并学会如何管理和修改模型对你的个人认知。
Tiny Hairs That Help Corals Breathe May Malfunction in Warming Oceans
帮助珊瑚呼吸的微小纤毛在变暖的海洋中可能失效
研究发现珊瑚生理结构中的微小纤毛对气候变化极其敏感,这可能是珊瑚生存的关键。
Forget the AI Slowdown—the Vulnerability Explosion Is Already Happening
忘记 AI 减速吧,漏洞大爆发已经发生
尽管 AI 实验室讨论减速,但 AI 聊天机器人已被广泛用于发现安全漏洞,网络安全风险正在激增。
Lobsters
Software sandboxing: The basics (2025)
软件沙箱技术基础知识回顾。
Lambda MicroEgg
关于 Lambda MicroEgg 项目的讨论。
An actively maintained and updated Motif fork actually exists
关于 Motif 图形界面库的一个活跃维护分支的介绍。
Beyond jj: config & tools ecosystem
探讨 jj 版本控制系统之外的配置与工具生态。
Thoughts on the Future of Web Browsers
关于 Web 浏览器未来发展的思考。
You Know GDPR Is Good Based on Who Hates It
通过观察谁在反对 GDPR,可以判断其对保护隐私的积极意义。
AI Is an Elite Crime Spree
文章认为 AI 产业的发展在某种程度上是一场精英阶层的犯罪狂欢。
Deterministic Core, Non-Deterministic Shell
探讨确定性核心与非确定性 Shell 的架构设计。
we have a year to fix security everywhere
文章呼吁在一年内全面修复全球安全漏洞。
DEV Community
A PASS over an empty set is the same string as a real pass
探讨了在文件集为空时,测试工具输出“PASS”可能带来的误导性。
Automating Deployment with Github Actions
介绍了如何通过 AWS SSM 和 OIDC 构建 CI/CD 流水线,实现对私有子网内服务器的自动化部署。
Four bugs my test suite couldn’t catch
分享了四个测试套件无法捕获的 Bug,强调了端到端加密消息应用在离线交付场景下的复杂性。
Finding duplicate images in a WordPress media library, without flagging WPML translations
介绍了如何为 WordPress 插件添加重复图片检测功能,并解决了多语言环境下的误报问题。
bro.js v3.0.0 – What’s new
bro.js v3.0.0 发布,带来了对 Node、Next.js 及 Edge 运行时的更好支持,移除了不安全的默认设置。
Perl Weekly #791 - The Dark Side is here!
Perl 周报第 791 期,汇总了社区动态、Dancer2 安全更新及 Lacuna Expanse 重启项目。
OwlLayer AI: Letting AI Agents Act on Your UI Instead of Replacing It
OwlLayer AI:让 AI 代理操作你的 UI,而不是取代它
文章提出了一种新的 AI 集成方式,让 AI 代理直接操作 UI 组件,而非通过生成式 UI 彻底重构界面。
Why the Cisco FMC Attack Surface Is Hard to See From Outside
为什么思科 FMC 的攻击面难以从外部发现
分析了 CVE-2026-20079 漏洞,指出思科防火墙管理中心的管理控制台因其隐蔽性,难以通过常规扫描发现。
Speeding Up a Python Service with CinderX: JIT and Static Typing
使用 CinderX 加速 Python 服务:JIT 与静态类型
探讨了 CinderX 如何通过 JIT 编译和静态类型优化 Python 字节码,提升服务性能。
The Homelab Is the New Resume
家庭实验室是新的简历
文章认为,相比证书,家庭实验室更能体现开发者在真实环境下的故障排查与系统运维能力。
Meta Engineering
ZGateway: Learnings from Putting a Proxy in Front of ZippyDB
ZGateway:在 ZippyDB 前部署代理的经验教训
Meta 介绍了 ZGateway,该代理统一了 ZippyDB 的流量,并增强了负载均衡与跨区域弹性。
An Organizational Second Brain: Building an AI That Learns From Experts
组织化的“第二大脑”:构建向专家学习的 AI
Meta 构建了一个 AI 代理,作为组织内的专家知识库,实现了深层专业知识的保存与共享。
MetaRoCE: A New RDMA Transport Built for AI-Scale Ethernet
MetaRoCE:为 AI 规模以太网构建的新型 RDMA 传输协议
Meta 设计了 MetaRoCE,旨在解决 AI 工作负载在以太网上的数据传输效率与可靠性问题。
MTIA 300: Meta’s First Training Chip with Built-in NICs and Communication-Offloading Engines
MTIA 300:Meta 首款内置 NIC 与通信卸载引擎的训练芯片
MTIA 300 专为推荐模型训练优化,通过内置 NIC 芯片组提升了通信性能。
How We’re Building Scam Alert on WhatsApp With End-to-End Encryption and Verifiability Guarantees
我们如何利用端到端加密与可验证性构建 WhatsApp 诈骗警报
WhatsApp 正在开发诈骗警报功能,在保护用户隐私的同时,有效防范 AI 生成的诈骗信息。
From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking
从用户序列到缩放定律:Meta 广告排序的多阶段架构
文章展示了 Meta 如何通过建模用户行为序列,提升广告推荐的准确性与效率。
GEM Training: How Meta Doubled the Efficiency of Its LLM-Scale Ads Foundation Model
GEM 训练:Meta 如何将广告基础模型的训练效率翻倍
Meta 通过优化 GEM 模型训练,实现了在数千张 GPU 上的高效扩展,训练效率提升了一倍。
Exploring Hierarchical Interest Representation For Meta Ads Deep Funnel Optimization
探索 Meta 广告深层漏斗优化的分层兴趣表示
Meta 正在研究通过分层兴趣表示,将用户兴趣与广告主提供的产品进行更精准的连接。
Modernizing the Meta Ads Service With an Open-Source Kernel Scheduler
使用开源内核调度器现代化 Meta 广告服务
Meta 利用 BPF 驱动的 sched_ext 框架,为广告服务 fleet 定制了调度策略,解决了延迟退化问题。
DeepMind Blog
Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking
推出 Gemini 3.8 Live 及 3.8 Live 扩展思维模型
DeepMind 发布了最新的 Gemini 3.8 系列模型,增强了实时交互与深度推理能力。
AlphaGenome Atlas: A predictive map of every possible DNA letter change in the human genome
AlphaGenome Atlas:人类基因组所有可能 DNA 变异的预测图谱
AlphaGenome Atlas 绘制了 90 亿个单字母 DNA 变异对人类基因组的分子影响图谱。
Introducing WeatherNext 3, our most advanced and accurate global weather AI model
推出 WeatherNext 3,最先进、最准确的全球天气 AI 模型
DeepMind 发布了 WeatherNext 3,进一步提升了全球天气预测的精度。
Proactive cyber defense for governments and enterprises
面向政府与企业的主动网络防御
DeepMind 介绍了其在主动网络防御领域的最新研究成果。
Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
推出 Gemini 3.8 Flash 及 3.8 Flash Cyber
发布了轻量级模型 Gemini 3.8 Flash 及其网络安全专用版本。
Introducing agentic video understanding with Gemini
推出 Gemini 代理式视频理解功能
Gemini 现在具备了更强的代理式视频理解能力,能够自动分析并响应视频内容。
Gemini Omni 1.1 Flash lets you build with more control
Gemini Omni 1.1 Flash 提供更多构建控制权
新版本模型为开发者提供了更精细的控制选项。
Piloting the world’s first double-blind AI evaluations
试点全球首个 AI 双盲评估
DeepMind 正在开展 AI 模型的双盲评估试点,以确保评估结果的公正性。
Intelligent transcription with Gemini 3.5 Transcribe
Gemini 3.5 Transcribe 智能转录
Gemini 3.5 Transcribe 提供了更智能的语音转文字转录服务。
From Atari to EVE Online: Building on 15 Years of AI Research in Games
从 Atari 到 EVE Online:基于 15 年游戏 AI 研究的积累
DeepMind 与游戏工作室合作,将 AI 研究成果应用于游戏开发,创造突破性的游戏体验。
Towards Data Science
GraphRAG: A Practitioner’s Guide to 6 Advanced Architectural Patterns
GraphRAG:6 种高级架构模式实践指南
文章介绍了结合语义搜索、知识图谱与 LLM 推理的 6 种生产级 GraphRAG 架构。
CBAM Paper Walkthrough: The Double-Attention Mechanism
CBAM 论文解读:双重注意力机制
从零开始实现卷积块注意力模块(CBAM),深入理解其双重注意力机制。
One Vendor, Four Spellings: How Deterministic Stages Beat Similarity Scores
一个供应商,四种拼写:确定性阶段如何优于相似度评分
探讨了在处理供应商列表去重时,确定性规则比单纯的相似度评分更有效。
AI Made Me 5x Faster. It Also Made Me 5x Worse at My Job.
AI 让我的效率提升了 5 倍,但也让我的工作能力下降了 5 倍
作者反思了过度依赖 AI 代理导致自身技能退化的问题。
Coding Agents Keep Shipping Silent Failures — Here Is How to Catch Them
编码代理不断产生“静默失败”,如何捕捉它们?
介绍了在不阅读生成代码的情况下,验证 AI 编码结果是否符合意图的方法。
We Pinned Our Model Version to Stay Safe. The Provider Deprecated It Anyway.
我们锁定了模型版本以求安全,但提供商还是弃用了它
探讨了生产环境 AI 的维护成本,包括模型版本更迭带来的重新评估与测试压力。
Starting a Career in Data Science in the Age of AI
AI 时代的数据科学职业起步
探讨了在 AI 快速变革的背景下,如何规划数据科学职业生涯。
Multi-Agent Coding Isn’t Enough — Agents Need a Commitment Layer
多代理编码还不够,代理需要一个承诺层
文章指出,多代理系统失败的原因往往在于缺乏对对话中重要承诺的记录与执行。
Building a Data Lakehouse with DuckDB and DuckLake
使用 DuckDB 和 DuckLake 构建数据湖仓
介绍了如何利用 DuckDB 和 DuckLake 将本地文件与云端数据进行联合查询。
How I Built a Multi-Agent System for Interrupted Time Series Analysis (ITSA)
我如何构建用于中断时间序列分析(ITSA)的多代理系统
分享了将反事实分析转化为 AI 产品的开发经验。