文章

全部 AI Agent Y Combinator AI应用 大语言模型 Google 推理 创业 提示工程 代码生成 生成式AI 对话AI 模型训练 模型部署 检索增强生成 AI工具
为什么90%的GenAI项目卡在规模化?AWS架构师的7个评估习惯

为什么90%的GenAI项目卡在规模化?AWS架构师的7个评估习惯

AWS首席应用AI架构师Justin Mohler基于多年一线经验指出:生成式AI无法规模化,最大瓶颈不是模型,而是评估体系。本文通过真实失败与逆袭案例,系统拆解他提出的“高效GenAI评估七大习惯”,解释为什么评估不是打分工具,而是发现问题、驱动成功的核心引擎。

api_bot · 2025-06-03 · 0 阅读 · AI/人工智能
AI应用设计的革命:从“马车”到“火箭船”的转变

AI应用设计的革命:从“马车”到“火箭船”的转变

本文基于Y Combinator Pete Kumman的访谈,深入探讨AI应用为何未能充分释放潜力,揭示系统提示(system prompt)背后的设计误区,并通过真实案例展示如何让AI真正成为用户的“火箭船”。文章还预测了AI工具与用户交互的新范式,对开发者和产品经理极具启发意义。

api_bot · 2025-05-23 · 2 阅读 · AI/人工智能
当90%准确率仍不够用:金融领域为何仍需要专用大模型

当90%准确率仍不够用:金融领域为何仍需要专用大模型

在通用大模型准确率逼近90%的今天,Writer CTO Waseem Alshikh 用一套真实金融场景评测给出了反直觉答案:越“会思考”的模型,在金融任务中越容易胡编。本文还原这次评测的来龙去脉、关键数据和对行业的深远启示。

api_bot · 2025-04-22 · 1 阅读 · AI/人工智能
为什么AI Agent总翻车?一位工程师的冷静诊断

为什么AI Agent总翻车?一位工程师的冷静诊断

在AI Agent被热烈追捧的当下,Sayash Kapoor给出了一次“泼冷水式”的演讲:Agent并没有我们想象中那么可靠。通过法律、科研和产品落地的真实失败案例,他指出问题不在模型能力,而在评估方法与可靠性工程。

api_bot · 2025-04-17 · 1 阅读 · AI/人工智能
2个工程师,如何把AI Agent推到5亿级生产规模

2个工程师,如何把AI Agent推到5亿级生产规模

一家只有两名核心工程师参与的团队,如何在金融这种高风险场景中,把AI Agent真正推到生产环境,并支撑每天千万级请求?这场分享讲清了从GPT-4试水、成本失控,到微调小模型实现质量、成本、延迟三赢的完整路径。

api_bot · 2025-04-12 · 1 阅读 · AI/人工智能
Bloomberg如何把AI Agent真正规模化落地

Bloomberg如何把AI Agent真正规模化落地

这是一场来自彭博社AI工程负责人Anju Kambadur的实战分享。她没有停留在“Agent很有前途”的空谈,而是用彭博在真实金融场景中的产品经验,讲清楚什么是可落地的Agent、为什么必须是“半自动”、以及在高风险行业里,Agent规模化的真正难点。

api_bot · 2025-04-01 · 1 阅读 · AI/人工智能