跳至正文
机理AI 前沿机制解读
首页文章归档RSS 订阅 ↗

文章归档

10 篇文章

2026年9月30日4 分钟阅读

OpenAI DevDay 2026:从单次推理到持续任务,开发者该区分哪些层

OpenAI 的正式回顾称,DevDay 2026 带来超过 20 项公告,覆盖 ChatGPT、Codex、模型和协作方式。[[3] DevDay 2026 Recap | OpenAI](https://openai.com/en-US/index/devday-2026-recap) 比罗列功能更重要的是区分:模...

2026年9月30日5 分钟阅读

Cloudflare cf:API 全覆盖之后,Agent 真正需要的是可发现、可约束的操作面

Cloudflare 发布 cf 的重点,不只是给 Wrangler 换一个更短的名字。官方把 API 模式、命令发现、JSON 输出和 TypeScript 配置放进同一套工具设计:让一个从未见过 cf 的 Agent,也能通过现场发现而不是训练记忆找到操作。[[1] Introducing cf: the agen...

2026年9月30日5 分钟阅读

EmDash 1.0:不是“没有运维的 WordPress”,而是重划插件与发布权的边界

EmDash 1.0 的官方发布文确认了基于 Astro 的开源 CMS、编辑后台、API、CLI 和内置 MCP,以及去中心化插件注册机制。[[2] EmDash 1.0: the stable CMS with a secure plugin registry | Cloudflare Blog](https://...

2026年9月29日5 分钟阅读

Claude 写了八成代码之后:Anthropic 的证据离递归自我改进还有多远

Anthropic 的《When AI builds itself》确实报告:截至 2026 年 5 月,其合入代码库的代码有超过 80% 由 Claude 编写。[[13] When AI builds itself \ Anthropic](https://www.anthropic.com/institute/r...

2026年9月29日5 分钟阅读

Google CC 家庭 Agent:共享日程之前,先理解共享身份与记忆

Google 的新 CC 确实面向家庭和同住群体,不是把早期个人邮件摘要随意改了名字。官方说明它拥有自己的 Google 账号,支持最多六位成员管理和协作,每个人自行选择共享哪些信息。[[10] CC is an AI agent for families and groups](https://blog.google...

2026年9月29日5 分钟阅读

Claude Sonnet 5.5:价格表只是起点,迁移真正要改的是请求与验收

Anthropic 对 Sonnet 5.5 的定位是面向边界明确的日常任务、修复 bug 和文档制作;官方同时承认,复杂且开放、需要持续判断的工作仍是 Opus 5.5 更强。[[4] Introducing Claude Sonnet 5.5 \ Anthropic](https://www.anthropic.c...

2026年9月29日5 分钟阅读

让 Claude 建 eval 再调 prompt:真正要守住的是题目、评分器和留出集

Anthropic 的工程文章确认了两个技能命令:`/claude-api build-eval` 用于在代码库里构建评估,`/claude-api hillclimb` 用于围绕评估逐轮优化。[[7] Automating eval design and hillclimbing with Claude / clau...

2026年9月29日4 分钟阅读

Eleven v4:表现力、长音频衔接与实时延迟,必须分开评估

ElevenLabs 已公开 Eleven v4 与 Eleven v4 Turbo;帮助文档分别使用 `eleven_v4` 和 `eleven_v4_turbo` 作为模型标识,前者面向质量优先的内容制作,后者面向实时对话和交互体验。[[12] What is Eleven v4?](https://elevenl...

2026年9月29日4 分钟阅读

Manus 2.0:Cascade、Studio 与云电脑,分别解决了什么问题

Manus 2.0 官方发布把 Cascade、Cloud Computer、Automations、Studio、Video Editor、Game Dev、Computer Use 和独立应用 Cue 放在同一个产品版图中。[[9] Introducing Manus 2.0](https://manus.im/b...

2026年9月28日4 分钟阅读

TypeSafe Jev:把答案约束成决策,不等于把概率变成确定性

TypeSafe 创始人 Diogo Almeida 的正式发布文将 Jev 定义为首个公开的 System One Model,面向软件可直接消费的快速结构化决策,并处于 early access。[[6] Introducing System One Models and Jev - TypeSafe AI Blo...

机理 / AI 前沿机制解读

从工具到系统,理解 AI 如何工作。

阅读归档搜索RSS 订阅
机制图为编辑示意,不代表性能、规模或实测结论。内容管理 / EmDash