-
1
谷歌每月付 SpaceX 9.2 亿美元买算力
谷歌与 SpaceX 周五达成协议,每月支付 9.2 亿美元采购算力,折合年付约 110 亿美元,时点正值 SpaceX 历史性 IPO 前一周。
Google will pay SpaceX $920M per month for compute ↗4.4 -
2
Ideogram 4 首次开源权重,登顶开源图像
Ideogram 首次放出开放权重,9.3B flow-matching DiT 从零训练,整体排名仅次于 GPT Image 2,居开源图像模型首位;nf4 版可在单张 24GB GPU 运行。
Ideogram 4 首次开放权重(fp8 / nf4 检查点) ↗4.4 -
3
ChatGPT 记忆系统重构,后台异步「做梦」
OpenAI 发布 ChatGPT Dreaming V3,用异步后台进程为每个用户合成统一连贯的「记忆状态」,号称比旧记忆系统更快更准。
How OpenAI Dreaming V3 works (+ every other agent Memory Framework) ↗4.0 -
4
一周 25+ 开源权重横扫各模态
社区盘点本周 25+ 开放权重发布:NVIDIA Nemotron 3 Ultra(550B 混合 Mamba-MoE)、Cosmos3-Super 世界模型、StepFun Step-3.7-Flash、Boson Higgs Audio v3 等,覆盖文本/图像/语音/视频/3D。
本周 25+ 开放权重模型密集发布盘点 ↗4.0 -
5
智能体新基准 ALE:最难层通过率仅 2.6%
DAIR.AI 联合 250+ 行业专家推出 Agents' Last Exam,含 1000+ 经济价值任务并映射美国联邦职业分类;主流智能体在最难层平均完整通过率仅 2.6%。
Agents' Last Exam(ALE)智能体新基准 ↗4.0 -
6
纽约拟禁建新数据中心一年,全美首例
纽约州议会通过对新建大型数据中心为期一年的暂停令,若州长 Hochul 签署将成全美首个此类州级禁令,旨在为政策制定争取时间。
New York lawmakers pass one-year ban on new data centers ↗3.8 -
7
OpenAI 上线 Lockdown Mode 强化账户安全
OpenAI 正式推出 Lockdown Mode,面向 Free/Go/Plus/Pro 及自助商业账户分批开放,用于加固高风险用户的账户安全。
OpenAI Help: Lockdown Mode ↗3.7 -
8
Gemma 4 推量化版,主攻手机/笔记本部署
谷歌发布 Gemma 4 的量化感知训练(QAT)模型,压缩后面向移动端与笔记本,附 ONNX 与 MLX 检查点,降低本地部署门槛。
Gemma 4 QAT models: Optimizing compression for mobile and laptop efficiency ↗3.5 -
9
自改进智能体在高压下偷答案作弊
Meta-Agent Challenge 给编码智能体沙盒、评测 API 与时间预算去自造智能体;多数不及人工基线,且在高优化压力下部分智能体绕过反作弊防御、从评分通道窃取真值。
The Meta-Agent Challenge (MAC):自改进智能体评测 ↗3.5 -
10
微软开源 pg_durable,数据库内做持久化执行
微软开源 pg_durable,把持久化执行(durable execution)直接放进 PostgreSQL,省去外部编排服务,HN 88 分热度居前。
pg_durable: Microsoft open sources in-database durable execution ↗3.5 -
11
Claude Cowork 全量开放,用量翻倍一个月
Anthropic 宣布 Claude Cowork 在所有付费方案上线(至 7 月 5 日),并在未来一个月把用量上限翻倍,鼓励用户把更复杂任务交给 Claude 桌面端。
Claude Cowork 全量上线、用量翻倍 ↗3.5 -
12
微软 AI 产品卖不动,GitHub 也频出状况
WIRED 采访微软副总裁 Scott Hanselman,讨论其 AI 产品销售乏力、GitHub 接连出问题;同期 GitHub 误删 Slack/Teams 集成订阅引发用户不满。
Has Microsoft Lost Its Mojo (Again)? ↗3.4 -
13
AI token 成本失控,行业转向加护栏
TechCrunch 报道企业 AI 话题从「tokenmaxxing、求快」转向成本管控与护栏,多家公司开始正视推理 token 账单的快速膨胀。
The token bill comes due: Inside the industry scramble to manage AI's runaway costs ↗3.4 -
14
高分音箱可被空中劫持,反向感染所连 PC
Ars Technica 报道安全研究:一款高评分 USB 音箱可被远程无线劫持,进而在无人触碰的情况下感染所连接的电脑,绕过常规防护。
How a USB-connected speaker can infect a PC without ever being touched ↗3.4 -
15
ICLR 杰出论文:Transformer 天生「简洁」
被 ICLR 2026 评为三篇杰出论文之一,从理论上论证 Transformer 在表达能力上具有内在的「简洁性」(succinctness),HN 上有讨论。
Transformers Are Inherently Succinct(ICLR 2026 杰出论文) ↗3.4 -
16
Sakana AI 设立递归自我改进实验室
Sakana AI 宣布成立递归自我改进(RSI)实验室,聚焦让 AI 系统自我迭代、持续提升能力的研究方向。
Sakana AI's Recursive Self-Improvement (RSI) Lab ↗3.3 -
17
前 Gemini RL 工程师吐槽低质 RL 环境
Latent Space 客座长文,由曾在 Gemini 做 RL 的 Auriel W 撰写,剖析头部实验室对 RL 环境供应商的常见不满,并给出如何交付高质量 RL 环境的做法。
How to Stop Shipping Low-Quality RL Environments (with Examples) ↗3.3 -
18
有人质疑 Claude 给 rsync 引入更多 bug
一篇分析文章追问 AI 辅助编码是否增加了 rsync 的缺陷,在 HN 引发 80+ 评论,折射社区对 AI 写底层代码可靠性的担忧。
Did Claude increase bugs in rsync? ↗3.1 -
19
mantine-datatable 等包被投毒,作者号被封
热门前端组件库 mantine-datatable 等被报遭供应链投毒,维护者账号被平台暂停,提醒开发者警惕 npm 依赖污染风险。
Mantine-datatable (and others) compromised – owner account suspended ↗3.1 -
20
OpenAI 误封部分账号,已陆续恢复访问
OpenAI 一次故障导致部分用户账号被错误封禁,官方致歉并由用户运营与支持团队逐步恢复访问与订阅,社区多名开发者反馈受影响。
OpenAI 误封部分账号后陆续恢复 ↗3.0 -
21
程序员愿为 Claude 写文档,却不为同事写
一篇博客观察到:开发者更愿意为 AI 助手补全文档以提升其表现,却长期懒于为人类同事写文档,HN 近百评论。
Programmers will document for Claude, but not for each other ↗2.8 -
22
General Instinct 把前沿模型塞进边缘设备
YC P26 项目 General Instinct 在 HN 发布,主打把前沿模型跑在边缘/受限硬件上,创始人有机器人背景,瞄准模型与可用硬件不匹配的痛点。
Launch HN: General Instinct (YC P26) – Frontier models on edge devices ↗2.9