最新动态
按时间阅读简讯,深入内容再看原文与专题。
Gemini 4 Pro 无需 Astra 级模型即可翻盘
我不明白为什么人们认为 Google 需要一个"Astra"级别的模型才能重回牌桌 gemini 4 pro 不需要那个 如果它只是与 op…
Meta muse 亮相获好评
muse 来俘获你们所有人的心了 🌹 引用 @ben_ai_eng:@alexandr_wang muse 太养眼了
Perplexity CEO 谈出口管制与中国开源 AI
Perplexity CEO Aravind Srinivas 称,开源与前沿模型之间 12 个月的差距唯一原因就是美国出口管制,并指 An…
Alexandr Wang 力荐 Muse
🥳🥳🥳 尽情享受吧! (引用 @grichadev):好吧 @Muse 不错,已经全面切换过去了
Google ScientistTwo 论文展示 AI 研究循环的自我改进能力
Google 发布 ScientistTwo 论文,展示 AI 研究中的递归自我改进:模型先改进人类方法,再以自身发现为新基线继续改进。它以…
Jev 能否成为更好的智能体评测器?
LangChain 测试了 Jev 与 LLM 评委在准确率、可重复性、延迟和成本四个维度的表现,以验证 System One 模型能否为智…
你能分辨哪些图片是 AI 生成的吗?
一个限时小游戏让玩家判断图片是真实照片还是 AI 生成,每张图限时 10 秒,整轮共 60 秒。游戏在计时开始前预加载首批图片,考验玩家的直…
Jev 模型每百万输入 token 仅 $0.042
一旦用了 Jev,就再也回不去了 【引用 @notkevinzhang】:四个词,十八个字母,每百万输入 token 仅 $0.042
Brood War Bench:Codex Astra、Claude Fable 与 Grok 4.6 等 Agent 的星际争霸对战评测
作者 bswerd 自建 Brood War Bench,让 Codex Astra、Codex 5.6、Claude Fable、Clau…
Elvis Saravia 用 Jev 为智能体框架 /goal 功能构建自定义验证器
Elvis Saravia 用 Jev 为智能体框架的 /goal 功能构建自定义验证器,每轮对话后检查目标是否真正完成,使持续验证成本低到…
HBO Max 官方 Reddit 账号遭入侵,针对 Mac 用户投放 ClickFix 钓鱼广告
黑客入侵 HBO Max 官方 Reddit 账号,投放持续约 48 小时的 ClickFix 钓鱼广告,诱导 Mac 用户把恶意命令粘贴到…
Kim 反驳陶哲轩:AI 加速不该慢下来
Kim 公开反驳 Terence Tao 的"必须放慢 AI 发展"观点,认为能源危机、疾病、全球饥饿等大量问题亟待解决,称"没有理由这么快…