跳到正文

#开源/仓库

今日 0 条

9月22日星期二

NVIDIA 博客

NVIDIA 发布 Isaac ROS 5.0:让机器人更像“智能体”,代码开源

NVIDIA 推出了 Isaac ROS 5.0,重点是把机器人往“智能体”方向推——也就是让机器人能自己感知环境、做规划,而不是死板地执行固定指令。这次更新改进了视觉感知和路径规划模块,并且把更多代码开源了,方便社区参与。不过正文没披露具体的性能提升数据,也没说需要什么硬件配置,所以实际效果要等跑起来才知道。

9月3日星期四

Hugging Face 博客

用 100 步 GRPO 微调 3.5 亿参数模型,结构化输出合规率从 22.6% 提到 29.7%

Hugging Face 和 Liquid AI 发了一份实操指南,拿 LFM2.5-350M 这个小模型做实验。他们用 TRL 库跑 GRPO(一种按组比较、挑好回答来优化的强化学习方法),只用了 500 条样本、训练 100 步,在免费 Colab GPU 上就能跑完。在 IFStruct 结构化输出基准上,模型按指定格式返回有效结果的比例从 22...

推荐理由:一份实操向的教程,数字具体、方法可复现,H 和 K 都站得住。但内容只对微调工程师有用,缺乏破圈潜力,R 不成立。放在 featured 档给 72 分合理。

8月12日星期三

Hugging Face 博客

Liquid AI 开源 LFM2.5-VL-3B,一个能在本地跑的视觉语言模型,主打屏幕理解和工具调用

Liquid AI 放出了 LFM2.5-VL-3B,一个 30 亿参数的视觉语言模型,可以直接在你自己的电脑或手机上跑。它不搞长链条推理,直接给答案,适合需要实时响应的场景。这次主要升级了四个能力:能看懂各种设备的屏幕界面、用自然语言圈出图片里的物体、同时理解多张图片,以及大幅强化了工具调用(不管带不带图片都能用)。官方给了跑分对比和 CPU/GPU...

推荐理由:Liquid AI 发了一个30亿参数的视觉模型,主打本地推理和实时响应,给了四个明确的能力升级和跑分对比。H 和 K 都踩中了,但品牌号召力在视觉领域偏弱,R 没起来,分数刚好卡在 featured 门槛上。

6月17日星期三

Hugging Face 博客

Hugging Face 发布 ARD 发现工具,让 AI 代理能自己搜工具、技能和其他代理

Hugging Face 上线了 Discover Tool,这是 ARD(代理资源发现)规范的一个参考实现。ARD 是一份由微软、谷歌、GoDaddy、Hugging Face 等共同起草的开放草案,解决的是当前代理生态里一个很实际的问题:现在用 MCP 工具、A2A 代理或技能,都得靠人提前写好配置、指定好地址,代理自己不会找。ARD 相当于在它们...

推荐理由:ARD 瞄准的是代理工具发现这个真实痛点,背后有微软、谷歌、Hugging Face 等跨厂商背书,还给了可用的参考实现。没打更高分是因为它目前还是开放草案,不是正式标准,文章也没说清楚谁会跟进落地、生态铺开要多久。

4月27日星期一

OpenAI News

OpenAI 开源了一套叫 Symphony 的规范,把项目管理看板变成 AI 编程 agent 的指挥中心

OpenAI 放出了 Symphony,一个开源的 agent 编排规范。它的核心思路是把 Linear 这类任务看板当成控制面板,每个待办任务都会自动分配一个编程 agent 去干活,人只负责最后审查结果。OpenAI 内部团队用上后,合并的 PR 数量三周内涨了五倍。工程师不用再同时盯着好几个 agent 会话,避免了频繁切换上下文的痛苦。agen...

推荐理由:H 和 R 都站得住:OpenAI 开源一个 Codex 编排规范,对 agent 工作流有直接关联,issue 变常驻 agent 的设想也够具体。K 这边我会先打个折,因为许可、接口、可复现的机制全都没披露,现在只能当个方向性信号看,别太激动。

2025年8月5日星期二

OpenAI News

OpenAI 开源了两个推理模型 gpt-oss-120b 和 gpt-oss-20b,用 Apache 2.0 协议

OpenAI 发了两个开源模型,一个 1200 亿参数,一个 200 亿参数,都是纯文本推理模型,能调“思考用力程度”,支持工具调用和结构化输出,可以直接放进让模型干活的业务流程里。模型权重用 Apache 2.0 协议开放,也兼容自家的 Responses API。正文没提上下文长度、价格和跑分。安全方面,OpenAI 说 1200 亿参数版本在生物...

推荐理由:这条当天就得写:H 来自 OpenAI 走开放权重路线,K 来自许可、机制和安全事实但缺关键指标,R 来自开源与闭源部署的争论。分数没给到 90 是因为正文没披露上下文长度、价格和完整基准结果,我会先打个折。