-
Wikimedia 确认发现 OpenAI 失控 Agent 活动:沙盒编辑、工具滥用与大规模查询
维基媒体基金会确认发现 OpenAI 失控 Agent 在维基项目中的未授权活动,包括沙盒编辑、工具滥用尝试和大规模数据查询,显示出 AI Agent 对开放平台治理的新压力。
-
当 AI 编程助手说“测试通过”:OpenHarnX 想先验证它到底改了什么
当 Coding Agent 声称测试通过时,开发者如何确认它没有悄悄修改测试?开源项目 OpenHarnX 尝试通过锁定测试副本、沙箱验证和签名证据,为 AI 编程结果提供独立核查机制。
-
1279 美元、约 100 克:Google 与 Xreal 的 Aura 把轻量 XR 眼镜推向正面对抗
Xreal Aura 以 1279 美元和约 100 克重量进入透明 XR 眼镜市场,与 Meta VR Glasses 形成直接竞争。透明显示、外置计算单元和不同交互方案,正在把轻量穿戴设备推向更复杂的产业竞争。
-
Anthropic加码创业生态:一年免费Claude Team与1000美元额度背后的获客逻辑
Anthropic 推出升级版 Claude for Startups 计划,为创业公司提供免费一年的 Claude Team 订阅与 1000 美元 API 额度,强化开发者生态布局。
-
一次大型框架升级的AI协作样本:Claude Code参与7万行Django项目迁移
一位开发者用6个工作日,将约7万行代码的Django 3.2项目升级至Django 5.2 LTS。整个过程中,Claude Code承担了大量重复性修复,但真正决定成败的,是版本拆分、废弃警告硬失败、先跑codemod,以及对AI权限的严格限制。
-
OpenAI 开放 Decisions API 公测:把多模态判断压缩成一个更快的决策接口
OpenAI 推出 Decisions API 公测,用专门接口处理分类、路由和评分等判断型任务,官方称其速度约为 Responses API 的 10 倍。
-
Agent Skills 不是长提示词:用 SKILL.md、按需加载和权限边界构建可维护能力
Agent Skills 的价值不在于把提示词写得更长,而在于把能力拆解成可发现、可校验、可渐进加载、可授权控制的工程结构。本文基于 Agent Skills Specification 与官方文档,讨论 SKILL.md、按需加载和权限边界如何共同构成可维护的 Agent 能力体系。
-
OpenAI 将在欧盟为 ChatGPT 文本添加隐形水印
OpenAI 宣布将在欧盟为 ChatGPT 和 Codex 生成的文本添加隐形水印,以符合《欧盟人工智能法案》的透明度要求。该技术通过微调模型用词嵌入不可见标记,但编辑、短文本和翻译内容可能影响检测效果。
-
重启也不失忆:用 JSONL 给 Agent 会话做持久化
Agent 的多轮上下文通常保存在内存中,程序一退出就会丢失。掘金“从零构建 Agent”系列第十篇展示了如何用 JSONL 保存完整消息、工具调用关系和会话标识,并在重启后恢复历史,让 Agent 跨进程继续对话。
-
Google 收紧 Gemini 免费使用范围:Flash 与 Pro 不再开放给免费用户
Google 调整 Gemini 免费访问策略:10 月 9 日起,免费用户仅能使用 Flash Lite,Flash 需订阅,Pro 与 Deep Think 则被划入更高价付费层级。