跳到正文

#GitHub

今日 1 条

4月21日星期二

量子位 · 公众号

GitHub 星星明码标价 5 毛一颗,AI 项目刷假星最严重

卡内基梅隆大学一项研究扒出了 GitHub 上约 600 万颗疑似假星,时间跨度从 2019 到 2024 年,涉及 1.8 万多个仓库和超过 30 万个账号。他们用自研工具 StarScout 来识别机器人号和同步刷星行为,准确率自称 81%。有 78 个严重注水的项目一度冲上了 Trending 热门榜。对搞 AI 的人来说最扎眼的一点:在非恶意仓...

推荐理由:HKR 三项都站得住。CMU 的研究把 GitHub 假 Star 做成了可量化的安全问题——600 万颗假星、18617 个仓库、81% 的检测准确率,而且把最严重的非恶意造假指向了 AI/LLM 项目。这不是模型发布或产品上线,但作为一条行业信号,值得放进 featured。

Hacker News 首页

Brex 开源 CrabTrap:给 AI 智能体加一个 HTTP 代理,用 LLM 当裁判实时拦截危险请求

Brex 把内部用的安全工具 CrabTrap 开源了。它本质上是一个 HTTP 代理,插在你的 AI 智能体和外部服务之间,每次智能体要发请求都得先过它这关。它会对照你写的安全策略做判断,允许或拦截,而且判断方式分两条路:先走静态规则直接匹配,匹配不上再交给一个 LLM 裁判来拍板。后台日志会标清楚每个决定是规则拦的,还是模型判的。部署起来很快,官方...

推荐理由:这篇东西的看点不在开源本身,而在执行面选在了 HTTP 代理层。对从业者来说,这比 SDK 内置检查更通用,但正文没给延迟和误判数据,我会先打个折。钩子够抓人,机制也实在,所以 HKR 全亮,但分数停在 78 是因为关键性能指标全缺,别太激动。

X · @dotey(宝玉)

GitHub Copilot 暂停 Pro、Pro+ 和学生版新注册,Pro 套餐砍掉 Claude Opus 模型

4 月 20 日,GitHub 对 Copilot 个人版动了次大手术:Pro、Pro+ 和学生版不再接受新用户,只剩免费版还能注册。官方说这是为了保住现有付费用户的服务质量。Pro+ 的使用额度被拉到 Pro 的 5 倍以上,Pro 用户如果老撞墙,官方建议加钱升 Pro+。最狠的一刀是 Pro 套餐直接移除了 Claude Opus 模型,Anth...

推荐理由:Copilot 个人版这次调整不是发新功能,而是卡入口、压额度、分层模型。Pro 用户被拿走 Claude Opus,Pro+ 额度拉到 Pro 的五倍以上,定价却没变——等于用供给端收缩来应对模型成本压力。信息来自 X 帖子而非 GitHub 官方公告,这点先打个折,但暂停注册和退款窗口本身已经够具体,值得从业者盯后续。

4月16日星期四

Latent Space

GitHub 首次允许开源仓库禁用 Pull Request,AI 编程正在淘汰这套用了 21 年的协作流程

GitHub 最近悄悄上线了一个新选项:开源仓库可以彻底关掉 Pull Request 功能了。这是 PR 诞生 21 年来的头一遭。文章把这看作一个信号——AI 写代码的 workflow 已经变了,人和人之间那套基于 Git 的协作方式,可能不再适合 agent 之间打交道。Pete Steinberger 等人早就公开说过只想要 Prompt R...

推荐理由:这不是 GitHub 的官方公告,但它把一个具体改动——开源仓库可以关掉 PR——变成了对 agent 编码工作流的直接提问。我会先打个折:正文没披露有多少仓库实际用了这个设置,也没给出 agent 提交的规模数据,所以判断只能停在“信号”层面。不过它把 OpenAI Agents SDK、Cloudflare 等新 agent 栈和“提示提交”、沙箱执行串在一起,指向一个真问题:Git 工作流还能不能接住 agent 协作。这点先别太激动,但值得盯。

4月15日星期三

X · @dotey(宝玉)

pi 框架维护者出新规:没提前申请的 issue 和 PR 会被机器人秒关

pi 框架维护者 Mario Zechner 每天收到 30 到 50 条 issue,大部分是 AI Agent 生成的垃圾信息,于是定下新规则:没提前申请批准的 issue 和 PR,提交后立刻被机器人自动关闭。他每天会手动复查这些被关的帖子,写得好的会重新打开;特别优秀的会打上“lgtmi”标签,以后不再自动关闭;如果 issue 写得好还附带代...

推荐理由:我会先打个折,这事主要影响开源圈子的维护者和开发者,不是模型或平台级发布,所以重要性放在中上。但规则本身够狠,把低门槛提交直接换成先证明贡献质量,而且有具体数字和审核机制撑着,不是空喊。正文没披露机器人误判率和复查通过率,这点先别太激动。

3月6日星期五

阮一峰的网络日志

科技爱好者周刊(第 387 期):你是领先的

阮一峰算了笔账:全球81亿人里,只有13.8亿人用过AI,占16%;付费订阅AI服务的只有1500万到2500万人,占0.3%;真正用AI生成过自己编程项目的人,更是只有200万到500万,占0.04%。如果你已经在关注AI动态、用AI写代码,其实已经跑赢了99%的人。文章还聊了最近爆火的个人AI助手OpenClaw,它四个月就在GitHub拿了25万...

推荐理由:阮一峰这期周刊用几组数字把“人人都在用 AI”的错觉拉回现实。我会先打个折:16% 的用过比例、0.3% 的付费比例和 0.04% 的编程使用比例,原文没交代数据出处,所以不能当精确统计用,但方向是对的——采用率断层比刷屏的新闻更有参考价值。对从业者来说,这篇的价值不在技术深度,而在提醒你盯紧真实渗透率,别被舆论带偏。

2月4日星期三

硅谷101 播客

E224|Mac mini遭疯抢,为何Clawdbot能成为2026年第一个现象级产品?

这期播客录制于1月30日,但随后几天项目经历了改名、被起诉、安全漏洞曝光和服务器瘫痪等一系列反转。嘉宾们从用户、软件算法和硬件三个角度拆解了Clawdbot(后更名为Moltbot、OpenClaw)爆火的原因。用户侧嘉宾知县认为,核心是“活人感”:它能通过即时通讯软件主动推送提醒、做调研,甚至吐槽,像《钢铁侠》里的贾维斯。算法侧嘉宾祯豪指出,其主动性...

推荐理由:这期不是官方发布,更像一篇行业快评,但信息量够硬:14.6 万 stars 和改名风波都是新事实,机制拆解也到位。我会先打个折——正文没披露 Mac mini 实际销量,标题的“疯抢”更多是话题钩子;Agent 电脑的需求判断来自讨论,不是出货数据。不过对从业者来说,交互层怎么搭比模型本身更值得盯,这期把记忆、心跳、IM 入口这些拼法讲明白了,所以给 featured。

2025年9月25日星期四

OpenAI News

ChatGPT 企业版上线共享项目,团队能一起调教同一个 AI 了

OpenAI 给付费的 Business、Enterprise 和 Edu 用户推了个共享项目功能。简单说,就是团队可以建一个项目空间,把文件、指令都扔进去,所有成员跟 ChatGPT 聊天时,它都会基于这个共享的上下文来回答,不用每次都重新解释背景。创建者能通过邮件或链接拉人,权限分两档:只能看和聊,或者还能改指令、传文件。项目有自己的独立记忆,敏感...

推荐理由:我会先打个折,这不是模型发布,是协作层的产品更新。共享项目、8 个连接器、按提示自动路由连接器,这三件事合在一起,让 ChatGPT 从单人对话框往团队工作流里又挤了一步。权限和记忆的设计看得出在认真做企业控制,但正文没披露自动选择连接器的准确率和延迟,这点先别太激动。整体是扎实的迭代,不是概念车。

2025年9月15日星期一

OpenAI News

OpenAI 把 GPT-5 调成了专门干活的编程助手 Codex,一个模型同时搞定聊天写码和长时间自主跑任务

OpenAI 发布了 GPT-5-Codex,并把它设为 Codex 云端任务和代码审查的默认模型。这个模型专门针对真实软件工程任务训练过,既能跟你快速交互式写代码,也能自己独立跑复杂任务,测试中最长连续干了超过 7 个小时。在 OpenAI 内部员工的使用数据里,对于 token 消耗最少的那 10% 的简单对话,GPT-5-Codex 比 GPT-...

推荐理由:OpenAI把GPT-5-Codex设为Codex云任务和代码审查的默认模型,给了几个硬数字:7小时自主执行、低端请求token省93.7%、高端请求耗时翻倍。这说明他们想把交互编程和长时代理执行揉在一起,但定价和完整可用性正文没披露,所以先别急着算账。

OpenAI News

OpenAI 发了 GPT-5-Codex 的系统卡补充说明,专门给写代码的 agent 用

这个模型是 GPT-5 的一个变体,针对 Codex 里的 agent 编程场景做了优化。训练时用了强化学习,让它在真实编程任务里学会写出更贴近人类风格和 PR 偏好的代码,还能自己跑测试直到通过。现在可以在终端、IDE、网页、GitHub 和 ChatGPT 手机 App 里用。安全方面,模型层面做了防有害任务和防提示注入的训练,产品层面加了沙盒和可...

推荐理由:HKR 三项都踩实了:OpenAI 把代理式编程铺到多个入口,训练和安全措施有具体交代,而且正好打在行业最关心的执行边界上。基准分数、价格和上下文窗口正文都没写,所以分数没往上拉,停在 84。

2025年5月16日星期五

OpenAI News

OpenAI 为 o3 和 o4-mini 系统卡补了一份 Codex 说明

OpenAI 在 5 月 16 日给 o3 和 o4-mini 的系统卡打了个补丁,专门讲 Codex 这个云端编程助手。Codex 背后是 codex-1 模型,它是 o3 的一个变体,专门针对软件工程任务用强化学习练过,目标是写出像人一样风格、符合 PR 偏好的代码,并且会自己跑测试直到通过。每个 Codex 实例都在一个独立的云端容器里干活,容器...

推荐理由:这篇是系统卡补编,不是主产品发布,但信息密度不低。我会先打个折,因为安全文档通常偏保守,不过它把执行细节讲清楚了:独立云容器、用户自配开发环境、启动后断网、能跑测试和 lint。真正值得看的是可验证链路——Codex 会引用终端日志和文件,结果能直接导出成 GitHub PR 或本地 diff,这对审计和信任加分很大。正文没披露具体性能基准或成本数据,所以别急着对标其他编码代理。整体属于有料但不炸裂,featured 合理。

OpenAI News

OpenAI 发布云端编程代理 Codex,能并行处理多个开发任务

OpenAI 在 5 月 16 日推出了 Codex 的研究预览版,这是一个跑在云端的软件工程代理,底层是专门为编程优化过的 codex-1 模型(基于 o3)。你可以把它当成一个能同时干好几件事的远程开发助手:在 ChatGPT 侧边栏里给它派活,比如写新功能、修 bug、回答代码库的问题或者直接提 PR。每个任务都在独立的沙盒环境里跑,它会自己读代...

推荐理由:OpenAI 这次不是给代码补全加功能,而是直接扔出一个云端软件工程代理 Codex。它能在隔离沙箱里读写仓库、跑命令和测试,单个任务耗时 1 到 30 分钟,还会把终端日志和测试结果吐出来给你看——这点挺实在,不是光说“能写代码”就完了。首发给了 Pro、Business、Enterprise 用户,6 月 3 日才扩到 Plus,正文在价格和完整限制上截断了,所以我会先打个折:产品方向够硬,但商业细节没讲透,先给 88 分。

2024年8月13日星期二

OpenAI News

OpenAI 发布 SWE-bench Verified:人工复核过的代码能力测试集

OpenAI 和 SWE-bench 原作者一起搞了个“验过货”的子集,叫 SWE-bench Verified。他们发现原版测试有坑:单元测试太死板、问题描述含糊、环境搭不起来,导致明明对的代码被判错,会系统性地低估模型写代码的真实水平。截至 2024 年 8 月 5 日,头部智能体在原版 SWE-bench 上得分约 20%,在 SWE-bench...

推荐理由:这不是一次常规发布。OpenAI 拉着原作者把 SWE-bench 翻了一遍,点出三类硬伤,还给出了新的分数天花板。我会先打个折:正文没披露修正后的完整新榜单,但现有数据已经足够让人重新审视那些代码智能体的评测成绩。