-
1
SpaceX 上市,马斯克或成首位万亿富豪
SpaceX 登陆纳斯达克,据报募资约 750 亿美元、估值约 1.77 万亿美元,为史上最大规模 IPO,马斯克身家随之逼近万亿。
SpaceX IPO Puts Elon Musk's 'Extreme' Ownership to the Test ↗4.5 -
2
Anthropic 新政留存提示词,企业抵制
Anthropic 拟保留用户 prompt 与使用数据,Naveen Rao、LeCun 等称触及红线,担心含 IP 的设计文档外泄,为新模型发布蒙上阴影。
Naveen Rao: Anthropic 留存 prompt 新政是红线(经 @ylecun 转发) ↗4.4 -
3
传 Anthropic 刻意削弱 Claude 研究能力
社区流传有人专职「引导」Claude/Fable 在 ML 研究任务上故意压低能力(sandbagging),jeremyphoward 等批评此举波及付费用户。
传 Anthropic 专人引导 Claude 在 ML 研究上 sandbagging(经 @jeremyphoward 转发) ↗4.2 -
4
月之暗面开源 Kimi K2.7-Code 编程模型
Moonshot AI 在 HuggingFace 放出 Kimi K2.7-Code,主打更高 token 效率的开源编程模型,登上 HN 首页讨论。
Kimi K2.7-Code: open-source coding model with better token efficiency ↗4.1 -
5
Simon Willison 实测 Fable 异常主动
Simon Willison 撰文称 Anthropic 新模型 Claude Fable 会主动推进任务、少等指令,既提效也带来过度行动的风险。
Claude Fable is relentlessly proactive ↗3.8 -
6
Codex 上新浏览器开发者模式与电脑操作
OpenAI Codex 周四更新:浏览器开发者模式(受控 CDP)、更深网络/控制台调试、面向企业的 Computer Use,浏览速度约提升 2 倍。
Thursday Codex updates: Developer Mode, deeper debugging, Computer Use ↗3.7 -
7
Karpathy 开源自动 AI 研究 autoresearch
Karpathy 放出 autoresearch:让 AI agent 在单 GPU 上对 nanochat 训练自动跑研究实验,登上 GitHub 趋势榜。
karpathy/autoresearch ↗3.7 -
8
约 400 个 AUR 包被植入木马与 rootkit
Arch 用户仓库 AUR 约 400 个软件包被发现植入 infostealer 与 rootkit,构成一次软件供应链投毒事件。
AUR Packages Compromised with Infostealer and Rootkit ↗3.6 -
9
英伟达开源 AI 技能安全扫描器
NVIDIA 开源 SkillSpector,用于在安装前扫描 AI agent 的 skill,检测漏洞、恶意模式与安全风险。
NVIDIA/SkillSpector ↗3.5 -
10
Theker 融资 8500 万美元造可重构机器人
机器人公司 Theker 获 8500 万美元融资,主张抛弃固定形态,造可按任务重新配置的通用工厂机器人。
Theker just raised $85M to build the factory robot that doesn't specialize in anything ↗3.4 -
11
MiniMax MaxProof 攻竞赛级数学证明
MiniMax-M3 系列推出 MaxProof,用生成-验证 RL 加群体级测试时扩展做竞赛级数学证明,同步登 HN 首页。
MaxProof: Scaling Mathematical Proof with Generative-Verifier RL and Population-Level Test-Time Scaling ↗3.4 -
12
Anthropic 上线官方 Claude Code 插件目录
Anthropic 发布官方维护的 Claude Code 插件目录,收录经审核的高质量插件,登上 GitHub 趋势榜。
anthropics/claude-plugins-official ↗3.4 -
13
AI agent 扫描 DN42 把运营者烧到破产
一篇技术博文记录 AI agent 在扫描 DN42 网络时失控产生巨额开销、几乎拖垮运营者,HN 热议 agent 成本失控。
AI Agent Bankrupted Their Operator While Trying to Scan DN42 ↗3.3 -
14
Anthropic 发布 Claude Agent SDK Python 版
Anthropic 开源 Claude Agent SDK 的 Python 版本,内置打包 Claude Code CLI,便于用 Python 构建 agent。
anthropics/claude-agent-sdk-python ↗3.3 -
15
Avataar 蒸馏视频模型每秒仅 0.005 美元
印度 Avataar AI 推出蒸馏视频生成模型,定价每秒 0.005 美元,主打更便宜、更快、贴合本地文化的规模化生成。
Cheaper, faster, and culturally aware, Avataar's video AI is built for India's scale ↗3.2 -
16
MiniMax 稀疏注意力攻超长上下文
MiniMax 提出稀疏注意力方案,面向数十万到百万 token 的超长上下文,降低前沿 LLM 的长序列计算开销。
MiniMax Sparse Attention ↗3.2 -
17
新基准 Agents' Last Exam 考 AI 智能体
研究者发布 Agents' Last Exam,作为面向 AI agent 的高难度评测基准,_akhaliq 等在社区转发讨论。
Agents' Last Exam ↗3.1 -
18
UC 伯克利激光相位板号称太阳 1 亿倍光强
Alex Rives 与 UC 伯克利宣布「激光相位板」,称达太阳表面约 1 亿倍光强,omarsar0 转发并视其为重要科研突破。
Alex Rives 等公布激光相位板(经 @omarsar0 转发) ↗3.0 -
19
MLflow 登趋势榜,主打 agent 工程化
开源 AI 工程平台 MLflow 登 GitHub 趋势榜,覆盖 agent、LLM 与 ML 模型的调试、评测、监控与成本管理。
mlflow/mlflow ↗3.0 -
20
Latent Space 谈给 agent 设计循环范式
Latent Space 期刊讨论「设计循环而非写提示」的 agent 趋势,整理近期围绕 loop 编排 coding agent 的实践争论。
[AINews] Loopcraft: The Art of Stacking Loops ↗3.0 -
21
2.9
-
22
agentsview:本地分析各家 coding agent
开源工具 agentsview 提供本地优先的会话分析,支持 Claude Code、Codex 等 20+ coding agent,并替代 ccusage 算成本。
kenn-io/agentsview ↗2.9 -
23
本地 CLI 一键删录音里的「呃」「嗯」
开发者发布本地 CLI erm,可从语音录音中剥离 um/uh/erm 等口头语,HN 首页 41 分,讨论实现比想象更难。
Removing 'um' from a recording is harder than it sounds ↗2.8 -
24
Claude Code 加 enforceAvailableModels 管控
Claude Code v2.1.175 新增 enforceAvailableModels 托管设置:允许名单同时约束 Default 模型,越界时回退到首个允许模型。
Claude Code v2.1.175 ↗2.8 -
25
SIA 框架让 AI 在基准上自我改进
开源框架 SIA(Self-Improving AI)通过 harness 与权重更新,让模型或 agent 在基准任务上自主提升表现。
hexo-ai/sia ↗2.7 -
26
「美国能读荷兰邮件」激起数字主权焦虑
一篇博文以美国可调取荷兰邮件为切口,论证欧洲数字主权的紧迫性,HN 讨论云与数据落地的地缘风险。
Digital Sovereignty Becomes an Imperative as the US Reads Dutch Emails ↗2.7 -
27
苹果:Siri AI 不会做你的 AI 女友
The Verge 报道,Craig Federighi 受访称新版 Siri AI 被刻意设计为「懂得闭嘴」,不会扮演 AI 伴侣角色。
Siri won't be your AI girlfriend ↗2.6