最新动态
按时间阅读简讯,深入内容再看原文与专题。
2025年11月13日
SIMA 2:在虚拟3D世界中与你共玩、推理和学习的智能体
Google 推出 SIMA 2,基于 Gemini 的 AI 智能体,支持在交互式环境中思考、理解并执行动作,可在虚拟3D世界中进行游戏、…
2025年11月04日
通过代码执行提升MCP智能体效率
随着AI智能体通过模型上下文协议(MCP)连接的工具数量激增,传统预先加载所有工具定义并通过上下文传递中间结果的方法,导致处理速度变慢、成本…
2025年10月26日
MedGemma:健康 AI 开发领域最强的开源多模态模型
谷歌 MedGemma 系列新增多模态模型,专为健康 AI 开发设计。作为该系列迄今最强的开源版本,新模型具备更强大的医疗场景理解能力,为开…
Gemini 2.5 Flash-Lite 正式发布,可用于规模化生产
Gemini 2.5 Flash-Lite 结束预览,达到生产级可用状态。这款高性价比模型在轻量体积下提供高质量输出,支持 100 万 to…
2025年10月24日
带 Deep Think 的 Gemini 高级版本在 IMO 中正式达到金牌标准
集成 Deep Think 的 Gemini 高级版本在国际数学奥林匹克(IMO)中达到金牌水平。IMO 自1959年起每年举办,是全球最顶…
CodeMender 发布:面向代码安全的 AI 智能体
CodeMender 是一款面向代码安全的 AI 智能体,利用先进 AI 技术自动修复关键软件漏洞。
Gemma 3 270M 发布:专为超高效 AI 打造的轻量模型
Gemma 3 系列新增 270M 参数模型,仅 2.7 亿参数,定位紧凑型超高效 AI 专业工具。
Gemini 2.5 Computer Use 模型发布
Gemini 2.5 Computer Use 模型基于 Gemini 2.5 Pro 构建,专门用于驱动能与用户界面交互的 agent,现…
2025年10月20日
超越权限提示:让Claude Code更安全、更自主
Claude Code引入沙盒化技术,通过文件系统与网络双重隔离来增强安全性,并大幅减少权限提示。内部测试显示,该技术将权限提示安全地降低了…
2025年10月16日
为智能体配备现实世界技能:Agent Skills 开放标准
Anthropic 推出了"Agent Skills"开放标准,旨在为通用智能体(如Claude)提供可组合、可扩展且可移植的领域专业知识。…
2025年10月07日
Claude Sonnet 4.5 发布,自动化对齐审计工具开源
Anthropic 上周发布 Claude Sonnet 4.5,期间使用新工具对模型进行自动化对齐审计以检测谄媚与欺骗行为。该工具现已开源…
2025年10月01日
Anthropic 工程博客新文:开发者熟知 prompt engineering,但要让 AI agents 发挥最大价值,你需要 context engineering
Anthropic 工程博客发文解释 context engineering。与 prompt engineering 不同,context…