Karpathy提出LLM不应被视为聊天机器人,而应被理解为新型操作系统的内核进程,能够协调多模态输入输出、代码执行、浏览器访问和记忆存储等功能。他将当前主流LLM(GPT、PaLM、Claude、Llama)类比为Windows/macOS/Linux,认为我们正处于一个全新计算范式的早期阶段。将LLM看作聊天机器人,就如同将早期计算机仅视为计算器一样短视。
AI 聊天助手
AI 助手、聊天机器人、个人 AI 与对话产品
AI 聊天助手 · 精选产品
Ojin
83Talk to an AI Agent with a real face and voice, in real time
Ojin 提供带有真实面孔和声音的 AI 智能体 API,支持实时打断式自然对话,只需一张照片即可创建可交互的数字人形象。
Gemini 3.8 Flash
82Most intelligent workhorse yet for coding and agents
Google 推出的最新 Flash 系列 AI 模型 Gemini 3.8 Flash,专为编程、智能体任务和多步推理设计,以极具竞争力的价格提供高性能的代码生成与自主任务执行能力。
Muse Code
82Meta’s terminal agent for long-horizon coding
Muse Code 是 Meta 推出的终端编程智能体,基于 Muse Spark 1.2 模型,支持长周期任务、仓库级代码执行与内置验证,旨在解决开发者处理复杂、跨文件、长时间编码任务的效率问题。
Health in ChatGPT
82Your personal health companion, powered by ChatGPT
Health in ChatGPT 是 OpenAI 推出的个人健康助手,通过整合健康数据、病历和健康应用,在对话中提供个性化健康洞察,帮助用户理解健康信息、准备就诊并养成健康习惯。
GPT-Live
82Full-duplex voice for ChatGPT
GPT-Live 是 OpenAI 为 ChatGPT 推出的全双工语音模型,支持同步听说、自然处理停顿与打断,解决了传统语音助手交互不自然、延迟高的问题。
Claude Sonnet 5
82AI that plans, acts, and gets work done
Anthropic 推出的最新 Claude Sonnet 5 模型,专注于 Agentic AI 能力,能够自主规划、执行任务,适用于编程和日常专业工作场景。
GhostWriter by MyHandler
79Two taps and it's already written
GhostWriter 是一款 Windows 本地 AI 写作助手,双击 Ctrl 键即可在任意应用的文本框中自动生成符合用户个人写作风格的回复,所有上下文数据(日历、文件、会议记录)加密存储于本地,兼顾效率与隐私安全。
Cline Desktop App
79An open-source app for open-weight models
Cline Desktop 是一款开源 AI 编程助手桌面应用,允许开发者自由选择模型与服务商,支持多 Agent 并发、任务自动化及插件市场,打破闭源生态束缚。
Clara AI SDR
78Turn website visitors into qualified pipeline
Clara 是一款 AI 销售开发代表(SDR),能够实时将网站访客转化为合格销售线索,自动完成资质审核、产品演示、异议处理和会议预约,无需人工干预。
Omni by xpander
78Stop babysitting your AI agents
Omni 是一个将本地 AI 工作流自动部署到云端的平台,让 AI Agent 能够持续运行、团队共享,并自动维护其健康状态。
min.
78AI that loves to follow up after meetings
min. 是一款能自动从邮件和会议中构建自身的 AI CRM,无需手动录入数据,帮助销售和业务人员自动积累客户关系上下文并辅助成交。
Hey Noah
78A proactive AI executive assistant for founders
Hey Noah 是一款面向创始人的主动式 AI 执行助理,自动管理日历、人脉关系和跨渠道(邮件、短信、WhatsApp)的跟进事项,确保没有任何重要事务被遗漏。
Zinley
78Your Personal AI Representative for calls, email, and tasks
Zinley 是一个拥有独立电话号码和邮箱的个人 AI 代理,可以替你接听电话、处理邮件、安排日程,充当用户的「数字分身」自主完成任务。
Greplica
78Self updating wiki for coding agents
Greplica 为工程团队和 AI 编程智能体提供一个共享的、自动更新的代码库知识库,持续从编程会话中提取决策、约束和上下文,解决静态文档过时和智能体记忆孤岛的问题。
ClinicFrame
78Like Granola, but for healthcare. Fully HIPAA-compliant.
ClinicFrame 是一款面向医疗从业者的 AI 环境听写工具,能在诊疗过程中实时生成结构化临床笔记,解决医生手动记录病历耗时耗力的痛点,并完全符合 HIPAA 合规要求。
SonOf
78Empty your backlog. Pay only when it ships
SonOf 是一个 AI 驱动的自动化工程服务,连接代码仓库和项目管理工具,自动审计代码库、编写并估算工单、完成开发任务,仅在代码成功上线时收费,帮助团队清空积压需求。
Agent Mode by Receiptor AI
78Bookkeeping assistant that runs receipt workflows end-to-end
Receiptor AI 是一款基于 AI Agent 的自动化记账助手,能够端到端处理收据工作流——从收件箱和手机采集收据、整理归档到云端或会计软件,并与银行交易自动匹配,解决中小企业和个人财务管理中繁琐的收据整理问题。
Brain² by ClickUp
78One AI that knows your entire company and acts on it
Brain² 是 ClickUp 推出的企业级 AI 助手,能够理解公司内所有任务、文档、对话和决策的全局上下文,并通过记忆、Agent 和 MCP 集成自动执行工作流。
Goldfish
78Press Option. It knows your work and replies like you
Goldfish 是一款 Mac 端 AI 写作助手,通过私密记录用户跨应用的工作上下文,让用户在任意文本框按下 Option 键即可获得无需重复解释背景的智能写作辅助。
Cignara
78AI Agents for Fortune 500 grade customer support
Cignara 为企业提供具备严格策略治理的 AI 客服代理,支持语音与文字全渠道对话,主打零幻觉、可验证的客户服务自动化。
Mina Meeting Assistant
78Your AI Teammate now responds and executes during your calls
Mina 是一个能在会议中实时发言、调用工具并执行任务的 AI 会议助手,解决传统会议工具只能记录而无法主动参与和推进工作的痛点。
CiteGraph
76Get your product mentioned and cited by AI assistants.
CiteGraph 帮助企业监控品牌在 ChatGPT、Claude、Gemini 等 AI 助手中的被推荐情况,识别竞争对手占据的 AI 回答位置,并提供具体优化建议以提升 AI 引用率,解决「AI 时代品牌可见性」这一新兴痛点。
Gemini app for Windows
74Alt + Space and Gemini is right there
Google官方推出的Windows桌面版Gemini AI助手,通过Alt+Space快捷键随时唤起,支持起草文本、执行智能任务,并深度整合Gmail、Docs、Google Drive上下文。
Loqua
74Speak naturally and move from thoughts to being done
Loqua 是一款 AI 语音生产力工具,让用户通过自然语音将想法直接转化为可用内容,并支持屏幕理解、朗读、翻译、编程等工作流,减少打字与上下文切换。
Nina by Antalpha
74Non-custodial AI Agent: research, predict & trade crypto
Nina 是 Antalpha(纳斯达克上市公司)推出的非托管 AI 交易助手,支持用自然语言查询加密货币和美股行情、生成交易建议与预测,用户自主签名钱包完成交易,兼顾机构级数据与个人资产安全。
Omi
74Ask your computer anything you saw or heard
Omi 是一款开源本地 AI 助手,通过捕获屏幕与对话内容,帮助用户回溯信息、生成会议摘要与任务提醒,解决知识工作者「记不住、找不到」的信息管理痛点。
Before Users Do
74Browser-backed QA for coding agents
一款通过 MCP 协议为 AI 编程助手提供浏览器级 QA 测试能力的工具,支持自动化测试与人工测试众包两种模式。
Superagent
74Claude Code for the rest of us
Superagent 是一款 macOS 本地客户端,为 AI 编程 Agent 提供图形化操作环境,替代命令行工具,支持浏览器控制、iOS 模拟器、文件访问和 iPhone 联动,无需账号和服务器。
Almanac
74The agent with a second brain
Almanac 是一个 AI 智能体,通过一键连接企业账户自动构建自更新的「公司大脑」,并常驻 Slack 与 iMessage 中持续后台执行任务,即使关闭电脑也不中断。
NINA
74Guide users step by step inside your product.
NINA 是一款嵌入 B2B SaaS 产品内部的 AI 引导助手,通过语音或文字实时帮助用户在界面上逐步完成操作,从而减少支持工单、文档查阅和重复性客服工作。
PromptQL
74Multiplayer AI that replaces Slack
PromptQL 是一款面向团队的多人协作 AI 工具,将共享 AI 对话线程引入团队工作流,替代 Slack 中碎片化的知识沟通,实现团队知识的沉淀与复用。
Deck
74The most capable AI assistant with its own inbox
Deck 是一个拥有独立邮箱的 AI 助手,可通过抄送方式接管邮件线程、执行多步骤任务,并主动推送重要信息和定时简报,帮助用户从繁杂事务中解脱出来。
Tough Tongue AI for Sales
74Live AI teammate for every tough sales conversation
Tough Tongue AI 是一款面向销售团队的实时 AI 队友工具,通过拟人化语音和虚拟形象,自动完成线索筛选、产品演示、新人培训等高压销售对话场景,支持电话、Zoom、Google Meet 等多渠道部署。
MiniMax M3
74Frontier coding, 1M context, native multimodality
MiniMax M3 是首个同时具备前沿编程能力、100万上下文窗口和原生多模态理解的开源权重大语言模型,面向开发者和 AI 应用构建者。
Airuncode
72Run multiple local coding agents on your machine
Airuncode 是一个本地优先的多智能体编码运行时,允许开发者在自己机器上并行运行多个 AI 编码代理,自带 API Key、支持云端与本地模型切换,并内置面向游戏开发的 Vulkan 3D 运行时。
Tucky
72Notes docked to your screen edge, with an AI agent inside
Tucky 是一款 macOS 原生便签应用,以极简条状形式停靠在屏幕边缘,内置 AI 智能体,支持本地加密存储,解决用户在不打断工作流的情况下快速记录与 AI 交互的需求。
Kit by Speakeasy
72Your coding agent runtime. Claude but fast, cheap, concise.
Kit 是一个编码智能体运行时,将终端客户端、ACP服务器、A2A端点和子智能体编排器集成为单一静态二进制文件,让 Claude 等模型更快、更便宜、更简洁地执行编程任务。
Ponytail
72Make new code the last resort
Ponytail 是一款面向 AI 编码助手的插件,通过在生成新代码前强制检查其必要性、复用性及标准库可用性,让 AI 写出最少、最精简的可工作代码。
Klaussy Desktop
72Hand it a ticket. Come back to a green PR. Free and local.
Klaussy Desktop 是一款本地桌面工具,允许开发者同时并行运行多个 AI 编程助手(Claude、Codex、Gemini 等),自动处理 PR 审查、CI 调试和代码提交检查,无需后端服务,使用自己的 API 密钥。
Onset MCP
72Write and publish release notes from your AI assistant
Onset MCP 是一款面向开发者的 AI 工具,通过 MCP 协议让 Claude 或 Cursor 等 AI 助手自动起草、排期并发布版本更新日志,彻底解放开发者在发布流程中撰写 changelog 的繁琐负担。
Tovel AI
72From conversation to action, in three steps
Tovel AI 将会议录音自动转化为 CRM 联系人、任务、跟进邮件等实际业务动作,解决会议记录停留在文字层面、无法驱动后续行动的痛点。
Superset Mobile
72Run your parallel coding agents from your phone
Superset Mobile 是一款 iOS 应用,让开发者可以在手机上管理和监控并行 AI 编程 Agent,随时启动任务、审查代码差异并接收通知,与桌面端 Superset 工作区无缝衔接。
Sider Code
72Reshape any website with plain words via Sider extension
Sider Code 是一款 Chrome 扩展,允许用户用自然语言描述需求,由 AI 自动理解网页结构并修改任意网站的外观与功能,无需编写代码。
Pluto
72Your professional profile is now an AI agent
Pluto 是一个 AI 语音代理,通过 10 分钟对话深度学习用户的职业故事,生成动态专业档案,让用户被合适的人和 AI 系统精准发现。
Hidini
72AI & Notes ovelay, hidden on screen sharing
Hidini 是一款 Mac 端轻量级 AI 悬浮层工具,能在屏幕共享时隐身,帮助用户在视频会议、面试等场景中实时获取 AI 辅助而不被他人察觉。
Assistly
72Real-time AI meeting overlay with no bots, 100% private
Assistly 是一款无需机器人加入会议的实时 AI 会议助手,通过本地音频捕获在屏幕上叠加显示实时指导,完全私密且不会出现在录屏中。
Jotform AI Data Assistant
72Turn form data into insights and action with AI
Jotform AI Data Assistant 是一款内置于 Jotform 表单平台的 AI 数据分析工具,让用户通过自然语言对话即可完成表单数据的分析、可视化和批量管理,无需公式或复杂操作。
Kora
72AI marketing & website management via WhatsApp
Kora 是一款面向餐厅和本地商家的 AI 营销助手,用户只需通过 WhatsApp 聊天即可完成网站更新、社媒发帖、广告投放和 Google 评论管理,无需任何技术技能。
Phantom
72Your app crashes, Claude fixes it on a branch you review
Phantom 是一个自主崩溃恢复代理工具,当终端命令崩溃时,自动调用 Claude 诊断 Bug、编写失败测试、在独立分支上修复并生成事后报告,全程不影响主分支。
FetchSandbox MCP
72The MCP that proves your AI's integration fixes work
FetchSandbox MCP 是一个面向 AI 编程助手的 API 沙箱工具,能够真实复现集成故障、验证修复效果,解决 AI 代码修复「通过 CI 但数据仍然错误」的核实难题。
infr.ad · ads pay, you code free
72Free LLM API. Ads in your terminal pay for it.
通过在终端响应末尾插入赞助商广告来补贴成本,为开发者提供完全免费、兼容 OpenAI 的 LLM API 服务。
Gemini for Students
72Introducing 1 Year Free Google AI for College Students
谷歌面向全球在校大学生提供一年免费 Gemini AI Pro/Plus 订阅及专属学生学习中心,以抢占学生用户市场。
Project SKY
72Your ambient AI companion for Windows.
Project SKY 是一款原生 Windows 桌面 AI 伴侣,通过屏幕感知、语音交互和长期记忆,帮助用户在不打断工作流的情况下完成任务自动化与智能辅助。
OneCLI
72Give every employee a secured, sandboxed pro assistant agent
OneCLI 是一个开源的自托管 AI 代理平台,为企业团队提供安全沙箱化的智能助手,可集成到 Slack 中,通过策略控制和凭证隔离让每位员工都能安全使用 AI 完成工作。
fx (by Vercel)
72Vercel's tiny, open-source coding agent
Vercel 推出的轻量级开源编码 AI Agent,以 Zig 编写、体积仅 6MB,专为低开销、高扩展性的本地或云端代码辅助场景设计。
Antigravity IDE Extensions
72Antigravity agents now live inside your existing editor
Antigravity IDE Extensions 将 Google 的 AI 编程代理平台集成到 VS Code、Visual Studio、JetBrains 和 Zed 等主流编辑器中,让开发者无需切换工具即可完成 AI 辅助编码任务。
CaseWax
72Private AI for law firms that runs entirely offline
CaseWax 是一款专为律师事务所设计的本地离线私有 AI 助手,可在 Windows 上运行,支持对大量案件文档进行问答、摘要和溯源,确保客户数据完全不上传云端。
Lifelong
72Your whole family’s health in one place.
Lifelong 是一款以家庭为单位的健康管理应用,帮助用户统一管理全家人的健康记录、用药、症状、预约及可穿戴设备数据,并通过 AI 助手 Alo 简化日常健康追踪。
Skim Recap
72Recaps what you skipped and explains where you get stuck
Skim Recap 是一款 Chrome 扩展,能自动捕捉用户快速滑过的文章段落并以卡片形式呈现,同时支持选词触发本地 AI 解释,帮助用户在阅读时不遗漏重要内容。
monolog
72Chat to yourself and find anything by what you remember
Monolog 是一款 AI 驱动的个人笔记工具,让用户自由书写而无需整理,通过语义搜索和智能提醒帮助用户随时找回所记录的内容。
AI 聊天助手 · KOL 观点
Karpathy 认为 AI 训练范式正经历第三次转型:从预训练(互联网文本)到监督微调(对话数据),再到如今的强化学习时代(环境交互)。他看好「环境」作为核心训练资产的未来,但对 RL 本身持保留态度,认为奖励函数存在根本性缺陷,人类学习方式远比 RL 高效,真正的突破尚未到来。
Andrej Karpathy 与 Sarah Guo 深度对话,探讨 AI 代理(Code Agents)的现状与未来,重点介绍其 AutoResearch 项目——让 AI 代理自主完成实验设计、数据收集和模型优化的闭环研究流程。同时讨论了自然语言编程的二阶效应、AI 时代的相关技能、模型分化(Model Speciation)以及 AI 对就业市场的影响。
Spotify首席架构师Niklas Gustavsson分享了公司在AI编程领域的前沿实践:73%的PR已由AI生成,任何人都能在1-2小时内完成原型开发。对话探讨了IDE的终结、AI代理处理2000万行代码的经验,以及异步编程工作流的组织变革。
Anthropic工程师Boris Cherny称其八个月未手写一行代码,现通过自动化循环每天运行数千个Claude Code智能体。核心论点是AI编程的真正跃迁不是从人工到单一AI助手,而是从人工提示到智能体自主编排循环(agents prompting agents)。验证机制是这一模式能否规模化落地的关键瓶颈。
Andrej Karpathy 发布了 nanochat 开源仓库,可在单张 GPU 上以约 100 美元复现完整的 ChatGPT 训练流程(含预训练、微调、RLHF 和聊天 UI),相比 2019 年 GPT-2 原始训练成本(43,000 美元、168 小时)下降了 99%+。文章作者逐行解析了该仓库的技术细节,并指出这标志着'自建 ChatGPT'从比喻变为现实。这一进展发生在美国政府限制 GPT-5.6 出口的同一周,形成鲜明对比。
nanochat 2026: Andrej Karpathy's Open-Source "ChatGPT for $100" — Full LLM Pipeline in 8,000 Lines
88Andrej Karpathy 于2025年10月发布 nanochat,一个约8000行 Python+Rust 代码的完整 LLM 训练流水线,涵盖从分词器到推理服务的全链路。其核心主张是用约100美元云GPU费用即可训练出具备真实对话能力的 GPT-2 级别模型,截至2026年6月已获54700个 GitHub Star,成为开源社区最受关注的 LLM 训练教程。
Claude Code创始人Boris Cherny分享了其团队实际使用Claude Code的10种工作流配置,涵盖并行多实例运行、计划模式、自我改进的CLAUDE.md、技能封装、MCP集成等核心实践。这些方法代表了AI编程助手在生产环境中的高级用法,具有较强的实操参考价值。
Andrej Karpathy 提出 LLM 交互范式正在经历第三次重大演变:从网页聊天机器人、桌面应用,进化为具备持久性、异步性、组织级工具和上下文的'团队成员'。这一范式要求底层完成跨工具、集成、计算环境、记忆和安全的系统性工程,使 AI 真正融入团队工作流,而非作为独立功能存在。
Anthropic Claude Code 创始人 Boris Cherny 表示,他每天管理数千甚至数万个 AI 代理,自己已八个月未手写一行代码。Claude Code 已实现自我编写与安全审查,并能自主浏览 GitHub 和 X 来决定下一步构建方向。他认为 AI 编程助手对软件创作的影响堪比古腾堡印刷机,将引发深远的社会变革。
这篇实证研究系统评估了'Vibe Coding'(AI驱动对话式编程范式),发现其相比传统编码效率提升27%,但同时带来更低的代码可维护性与更高的安全漏洞风险。研究揭示了AI编程的核心悖论:生产力增益与质量控制失衡,并提出了'混合集成、人工监督、场景感知部署'三支柱负责任采纳框架。
Andrej Karpathy 发布开源项目 nanochat,仅用约8000行 Python 和 Rust 代码实现了从零构建类 ChatGPT 模型的完整训练与推理流程,项目在 GitHub 单日获得14.5k星。该项目支持以约100美元、4小时训练出可对话的 LLM,12小时后性能可超越 GPT-2 的 CORE 指标。Karpathy 同时表达了对 Agent 框架的质疑,认为其反而会阻碍工作流程。
Boris Cherny(Claude Code 核心开发者)建议开发者删除 CLAUDE.md 中的大部分内容,因为每一行指令都会在每次对话中被模型读取,造成无效上下文负担。他的原则是每6个月清空一次,只有当模型在实际使用中反复出错时才重新添加对应规则。Opus 5 发布后,他的团队已将 Claude Code 自身的系统提示削减了80%。
Andrej Karpathy认为2025年并非AI爆发年,AGI需要数十年才能实现。他指出当前AI系统最核心的缺陷是缺乏记忆与连续性,现有'智能体'本质上是每次对话都失忆的'幽灵'。真正的AGI需要三条路线同时推进:认知理解、工具操作与持久存在,最终从token生成走向action执行。
Andrej Karpathy 提出用 LLM 构建个人知识库(wiki)的工作流:将源文档存入本地文件夹,由 LLM 提取整理成持续更新的 Markdown wiki。作者亲测后认为这是今年最有效的生产力工具,适合需要研究助手的知识工作者。文章同时涵盖了作者年度生产力工具盘点。
本文基于 Claude Code 创始人 Boris Cherny 的 AI 采用阶梯模型,结合 Spring Boot 实际项目,系统梳理了团队/个人在 AI 工具采用过程中的五个层级(从纯聊天窗口到自动化 Agent 流水线),并指出每个阶段的瓶颈与突破所需的'护栏'。核心洞察是:推进到下一层级的关键不是更多 token,而是识别并消除当前的结构性瓶颈。这为开发者和团队提供了清晰的自我定位框架和进阶路径。
Claude Code创始人Boris Cherny讲述了该产品从Anthropic内部副项目到核心产品的演变历程,探讨了AI编程助手对软件工程师技能需求的重塑,以及在安全对齐、企业采用和SaaS颠覆等方面的深层影响。他认为2026年是AI编程工具爆发之年,代码编写能力本身已不再是工程师的核心竞争力,系统思维和问题定义能力更为关键。
本文深入分析了 Claude Code 的工程架构与产品决策,核心论点是通过将 AI 模型直接嵌入终端环境(而非聊天界面),释放了模型已有的潜在能力('产品过剩'),从而实现了自主代码库导航。该工具在五天内获得 Anthropic 半数工程师日常使用,目前年化收入已超 5 亿美元,占 GitHub 公开 commits 的 4%。
Andrej Karpathy 与 Sarah Guo 深度对话,探讨代码智能体的现状与极限、AutoResearch 项目(AI 自主完成实验设计、训练与优化的闭环研究系统),以及 AI 时代工程师和教育者的相关技能演变。核心议题涵盖模型分化(Model Speciation)、人机协作界面设计、就业市场数据分析,以及自主机器人与 MicroGPT 教育应用。
OpenAI联合创始人Greg Brockman阐述了将聊天与智能体融合的产品愿景,认为未来界面本身将消失,演变为代表用户持续行动的个人AGI。他强调算力是AI竞争的核心稀缺资源,并预测当前高价智能将逐步商品化,同时对AI在健康领域的潜力最为乐观。
Andrej Karpathy 指出 AI 正经历第三次交互范式革命:从网页聊天机器人、独立应用,演进为嵌入组织工作流的持久化「数字队友」。以 Claude 的 Slack 集成为例,AI 将以异步、上下文感知的方式无缝融入团队协作,而非作为独立工具被调用。这一转变标志着 AI 从「工具」到「成员」的身份跃迁。
Andrej Karpathy 提出 LLM Wiki 概念:让 LLM 维护一套持续增长的 Markdown 知识库,而非每次从原始文档重新检索。Google 随后发布 Open Knowledge Format (OKF) 将其标准化为可互操作的格式。该模式本质上是为 Agent 实现跨会话的长期记忆层,适合需要知识积累的助手类和研究类 Agent。
AI工程的下一阶段不再是人工提示,而是构建自动化循环让系统自主与AI交互。Boris Cherny提出'Loop Engineering'概念:工程师的核心工作从写提示词转变为设计驱动AI的循环逻辑。这标志着AI编程范式的根本性转变——从人机对话到机器自主编排。
Andrej Karpathy 公开抱怨 AI 编程助手的核心缺陷——过度假设、画蛇添足、不懂反馈——随后一个开发者将其总结为 65 行的 CLAUDE.md 文件,迅速成为 GitHub 最热门仓库(57,000+ stars)。该文件的四条规则本质上是通用的工作原则:先思考再行动、追求简洁、最小化改动、目标驱动执行,与技术本身无关。
Claude Code创始人Boris Cherny分享了掌握AI编程助手的核心工作流:探索→规划→确认→编码→提交。强调上下文的重要性(CLAUDE.md文件)、让AI先规划再执行、以及并行运行多个会话提升效率。核心洞察是:优化AI工具的关键在于围绕模型的'setup',而非prompt措辞本身。
Anthropic发布Claude Fable 5.1和Mythos 5.1,重点提升编程、数据分析、计算机使用及长时间智能体任务能力。同时大幅降价(缓存读取降至$0.25/百万token,典型Claude Code会话降价38%),并减少安全护栏对正常请求的误拦截(生物安全误拦截减少85%,网络安全干预减少60%)。此外改善了模型写作风格,减少'Claude腔'。
Greg Isenberg 提出将 Claude Code 从普通聊天机器人转变为自主 AI 员工的框架,核心是从'提示者'转变为'管理者'思维。通过构建包含业务上下文、客户反馈和例行任务的结构化知识库,为 AI 提供持久记忆和操作环境。具体、可执行的任务指令(类似工单)是获得高质量输出的关键。
Vibe-coding初创公司(如Lovable、Replit)正以高估值获得大量风投青睐,这类工具通过AI对话界面让非技术业务用户也能快速构建应用原型,正在复制此前低代码/无代码工具进入企业的路径。早期采用者已看到显著成效,但CIO们同时面临质量管控、治理和安全等挑战。
Anthropic工程师Boris Cherny建议开发者删除CLAUDE.md指令文件,因为Opus 5模型已足够智能,无需大量历史补丁指令。但作者指出,简单删除只解决了数量问题,而非质量问题——真正的挑战是识别哪些规则仍是必要的'承重墙',需通过类似Anthropic内部的逐行消融测试来科学评估。
企业正在从简单聊天机器人进化到构建内部'脑代理'——拥有独特'灵魂'(指令+数据权限)的自主AI员工。核心转变是从'提示词工程'到'智能体架构工程',将AI代理视为模块化员工来管理。安全治理和人机协作审批机制是落地最难的部分,而非AI模型本身。