作者基于为跨公司工作的 Agent 构建记忆系统一年的经验指出,AI 失败的常见原因不是模型推理差,而是它看不到关键决策上下文,多数 agent memory 只是给瞎子更大的档案柜。
查看原文:https://tessl.io/blog/your-ai-isnt-stupid-its-blind
来源:Tessl:产品与工程博客
作者基于为跨公司工作的 Agent 构建记忆系统一年的经验指出,AI 失败的常见原因不是模型推理差,而是它看不到关键决策上下文,多数 agent memory 只是给瞎子更大的档案柜。
查看原文:https://tessl.io/blog/your-ai-isnt-stupid-its-blind
来源:Tessl:产品与工程博客
Anthropic 发表对 Block AI capabilities 负责人 Bradley Axen 的访谈,介绍 Block 用 Claude Fable 5 编排大规模代码迁移:Fable 做数据模型、API 规格等高层设计,再调度...
据金融时报报道,OpenAI 向投资者披露截至 9 月底年化营收逼近 500 亿美元,大幅低于此前外界估算的 700 亿美元,缺口约 200 亿美元。差异源于统计口径不同,Anthropic 计入 AWS 和谷歌云等合作方销售收入,而 Op...
Hugging Face 工程师 yuvraj sharma 用 HuggingChat 的 ML Intern 模式在几天内做出 7 个模型,包括可在 CPU 运行、99.7% 有效输出的 0.8B 提示词重写器,以及将柑橘病害识别准确率...
Arena 完成 2 亿美元 B 轮融资,估值 31 亿美元,由 Lightspeed 和 Khosla Ventures 联合领投,a16z、Felicis、Salesforce Ventures、The House Fund 等参投。自...
Arena 公布 Anthropic Claude Haiku 5.5 (High) 的真实评测结果,在 Code Arena: WebDev 以 1587 分首秀排名第 30,略在 Pareto 前沿之外。 查看原文:https://x....
Anthropic 推出 Anthropic Cyber Mission,长期支持关键基础设施和开源软件的防御方,首期包括 Critical Infrastructure Defense Program(CIDP)和免费的 OSS Scan...
Anthropic 发布 OSS Scanner,一个可选加入的开源漏洞扫描服务,用其最强模型(包括 Claude Mythos)定期免费扫描开源项目,输出为全模型生成、无人工复核的报告。 查看原文:https://www.anthropi...
Anthropic 发布 Claude Dashboards 和 Claude Motion 两项 beta 功能。 查看原文:https://claude.com/blog/dashboards-and-motion 来源:Claude:...
微信扫码分享


