-
1
GLM-5.2 跻身开源前沿逼近闭源
智谱 GLM-5.2 在 GDPval-AA 以 1524 Elo 列第三,仅次于 Claude Fable 5 与 Opus 4.8;Cline 实测较 Opus 4.8 更省更稳,已上架 AWS、Baseten 等多家推理平台。
GLM-5.2 跻身开源前沿,逼近闭源顶级模型 ↗4.5 -
2
SpaceX 成 280 亿/年 Neocloud
SpaceX 第三笔 GPU 租赁签给 Reflection(63 亿美元、月付 1.5 亿用 GB300),叠加 Anthropic、Google 约单,合计月入 23 亿、年化约 280 亿美元,约为 Coreweave 两倍。
SpaceX 已是 $28B/年 Neocloud ↗4.4 -
3
OpenAI 推 GPT-5.5-Cyber 主攻安全
OpenAI 扩展 Daybreak 计划,发布面向可信防御者的 GPT-5.5-Cyber 与 Codex 安全插件,已扫描 3000 万+ 提交、生成 7 万+ 修复,自称在 CyberGym 上达 SOTA,从「找漏洞」转向闭环打补丁。
OpenAI Daybreak – GPT-5.5-Cyber ↗4.4 -
4
Gemini Interactions API 升为默认接口
谷歌将 Interactions API 升为 Gemini 模型与 agent 的默认接口并 GA,整合模型/agent 调用、后台异步执行、托管 agent 与隔离远程 Linux 沙箱 Antigravity。
Google Gemini Interactions API 转为默认接口 ↗4.4 -
5
3B 小模型 VibeThinker 推理超 Opus 4.5
arxiv 新论文 VibeThinker 用新颖的 SFT+GRPO 训练,仅 30 亿参数即在推理基准上超过 Opus 4.5,HN 引发讨论,挑战「参数规模等于能力」的直觉。
VibeThinker: 3B 模型用 SFT+GRPO 在推理上超过 Opus 4.5 ↗3.8 -
6
英伟达放出官方验证的 agent skills
英伟达发布官方认证的 AI agent skills 仓库,主打「能力治理」与可验证技能,配套文档与博客,进入 agent 工具标准化与安全审查的竞争。
NVIDIA/skills ↗3.8 -
7
Baseten 完成 F 轮押注推理与自有模型
推理平台 Baseten 官宣 F 轮融资(约 15 亿美元),押注企业「自有/后训练开源模型 + inference 控制层」路线,客户含 Cursor、Notion、Harvey、Abridge 等。
Baseten 完成 F 轮融资 ↗3.6 -
8
Anthropic 文档现 Claude Fable 5、Mythos 5
Anthropic 系统提示文档更新,模型列表新增 Claude Fable 5(6 月 9 日条目)与 Claude Mythos 5,与 Opus 4.8 等并列在售,确认 Fable/Mythos 5 代已上线。
Anthropic 系统提示文档更新,现 Claude Fable 5、Mythos 5 ↗3.6 -
9
Sakana 发布编排层 Fugu,基准遭质疑
Sakana 推出 Fugu——跨多前沿模型学习选择/委派/校验/综合的单一 API,Vercel 已接入 AI Gateway;但因基线匿名、缺成本核算、SWE-Bench Pro 落后 Opus 约 10 分招致批评。
Sakana 发布编排层 Fugu,基准透明度遭质疑 ↗3.6 -
10
Garry Tan 开源其 Claude Code 工具栈
YC 总裁 Garry Tan 开源个人 Claude Code 配置 gstack,含 23 个分饰 CEO、设计、工程经理、发布与 QA 等角色的工具,称自己已数月不手写代码。
garrytan/gstack ↗3.6 -
11
Ultralytics 发布端到端视觉模型 YOLO26
Ultralytics 推出 YOLO26,主打统一的实时端到端目标检测、去除 NMS 后处理,arxiv 论文与 Roboflow 入门解读同期发布,面向 CV 工程落地。
Ultralytics YOLO26: Unified Real-Time End-to-End Vision Models ↗3.4 -
12
新框架把提示注入归为角色混淆
Simon Willison 介绍一篇论文,将提示注入重新诠释为模型「角色混淆」,为 LLM 信任边界与防护设计提供新的分析视角与缓解思路。
Prompt Injection as Role Confusion ↗3.4 -
13
0.2B 修复模型 Moebius 移植进浏览器
Simon Willison 用 Claude Code 把 Moebius 0.2B 图像修复模型移植到浏览器端运行;该模型以 2 亿参数实现接近 10B 级别的局部重绘效果。
Porting the Moebius 0.2B image inpainting model to the browser ↗3.4 -
14
Hindsight:会随时间学习的 agent 记忆
开源项目 Hindsight 提供「会学习」的 agent 记忆系统,强调随使用持续改进而非单纯检索召回,附论文与 cookbook,登上 GitHub Python 日榜。
vectorize-io/hindsight ↗3.4 -
15
HeyGen 开源 HyperFrames:HTML 渲染成视频
HeyGen 开源 HyperFrames,让 agent 用 HTML/CSS/媒体描述并渲染出可寻址动画视频,面向「写 HTML 出视频」的生成式工作流,登上 GitHub 全语言日榜。
heygen-com/hyperframes ↗3.2 -
16
三人植入可检测癌症的脑机接口
Coherence Neuro 启动脑机接口临床测试,已为三人植入,未来或借电刺激抑制肿瘤生长,是 BCI 在肿瘤监测/干预方向的早期人体试验。
3 People Have Gotten Cancer-Detecting Implants in Their Brains ↗3.2 -
17
Firecrawl:给 agent 的规模化抓取 API
开源项目 Firecrawl 提供面向 agent 的网页搜索、抓取与转 Markdown/结构化数据 API,定位为 agent 的「网页上下文」入口,登上 GitHub 全语言日榜。
firecrawl/firecrawl ↗2.9 -
18
AI 治理文明实验:造出核弹仍败
一篇实验博客让 AI 独立经营一个文明模拟并记录其决策链;AI 一度造出核武器却仍未取胜,引出对长程自主决策与规划能力的讨论,HN 上热度不低。
AI Built a Nuke and Still Lost ↗2.9 -
19
多 agent AI 对冲基金 demo 登趋势榜
开源教学项目 ai-hedge-fund 用多 agent 模拟对冲基金投研与交易决策流程,明确仅供研究、非实盘,登上 GitHub Python 日榜。
virattt/ai-hedge-fund ↗2.8