AI 工具与工作流札记
实测、教程和可复用的经验
从真实使用场景出发,记录 AI 工具、自动化流程和内容系统的有效做法。
热门话题
用标签快速缩小范围。

LLM 写作的致命伤不是质量,是所有人都长一个样
Ethan Mollick指出LLM写作风格缺乏多样性是致命问题。USC研究证明LLM正在磨平人类表达的认知多样性。风格不是修辞技巧的堆叠,而是冒险的痕迹。在AI让一切变得平滑的时代,粗糙本身就是价值。
#AI 工具- AI
- LLM
- 写作

AI 搜索正在杀死内容互联网
ChatGPT搜索中site:运算符查询暴增46倍,Reddit引用骤降86%,Google推出Preferred Sources按钮自救。AI搜索正在从根本上重写互联网内容分发逻辑,内容创作者面临结构性的生存危机。
#AI 工具- 内容创作
- AI
- 搜索

同一道题换个说法,模型分数能差74.7个百分点——我们用来衡量AI的尺子,本身就是歪的
IBM BenchDrift论文发现:在同一道数学题、同一个正确答案的前提下,仅仅因为题目的措辞不同,大语言模型的准确率波动幅度平均是74.7个百分点。排行榜第一名可能只是碰巧没被这套措辞难住的幸运儿。
#AI 工具- AI
- Benchmark
- AI研究

OpenAI 踩刹车:当最激进的玩家开始害怕自己造的东西
OpenAI 暂停了下一代模型 Astra 的强化学习训练。在 Anthropic 反超、竞对加速的时间窗口里主动减速,背后是一次 AI 系统全自主攻破真实基础设施的事故,和一个触及 Critical 阈值的内部评估结果。AI 安全从学术议题变成了工程问题。
#AI 工具- OpenAI
- AI
- ai-safety

亚马逊在焚书——当AI训练数据变成一场数字考古掠夺
404 Media通过AirTag追踪发现亚马逊在拉斯维加斯VGT3仓库批量购买珍本旧书、切割装订、扫描后销毁,用于AI模型训练。这是一场系统化的数字考古掠夺:2022年前的实体书是地球上最后一批纯人类文本矿藏,不可再生。
#AI 工具- 独立思考
- AI
- 版权
- +1

Stripe花70亿买了AI世界的收费站
82天,从13亿到70亿。Stripe收购OpenRouter的价格对应140倍PS,但它买的不是5000万年收入,而是AI经济的流量入口、全行业需求侧情报、以及从模型选择到token结算的完整闭环能力。
#AI 工具- AI
- AI基建
- Stripe
- +2
AI时代最稀缺的不是算力,是「知道自己不知道什么」
AI时代真正稀缺的资源,不是算力,不是数据,是知道自己不知道什么。
- AI
- Agent
- 方法论
- +1

DeepSeek Harness 开源两天,我装了这 8 个插件
DSH v0.1 开发者预览版发布两天,GitHub 上冒出七百多个社区插件。我从中筛选了八个覆盖核心场景的插件:Web UI 全家桶、视觉工具包、搜索引擎、多 Agent 协作、桌面操作、跨会话记忆、上下文体检和轨迹调试。
#AI 工具- 开源
- AI
- Agent 工程化
- +2

DeepSeek 做了一个 Agent 的操作系统
DeepSeek 开源了 Harness v0.1,一个"一切皆插件"的 Agent 运行时框架。内核几乎为空,所有能力来自可热插拔的插件。MIT 许可证,12293 个 commit,四种出厂模式。这不是一个产品发布的故事,这是一个设计哲学的故事。
#Agent- 开源
- Agent 工程化
- DeepSeek

AI终于学会了「记住自己在想什么」
GPT-5.6 推理持久化让 Agent 从反复失忆变成持续思考。两行配置改动,ARC-AGI-3 分数涨 188%,BrowseComp 成本降 25 倍。Agent 的军备竞赛进入新阶段,比的不再只是模型更聪明,而是谁更早让 AI 记住自己在想什么。
#AI 工具- 大模型
- OpenAI
- Agent 工程化

一个Python包被投毒40分钟,2500家公司密钥全暴露!AI供应链安全最大盲区曝光
LiteLLM开源包遭供应链攻击,恶意版本在PyPI仅存在40分钟,却可能暴露2500家组织的云凭证。AI安全最先塌方的不是模型本身,而是那些没人关注的管道。
#AI 工具- AI安全
- 开源
- AI
- +1

「100%人写」学术代写全是AI!假博士、偷身份、AI接电话,1900美元骗局被记者一通电话戳穿
一家叫Research Gold的学术代写网站承诺100%人写,但从博士团队到客服电话全是AI在运转。当「人写」变成溢价标签,围绕这个标签的造假产业链比AI本身更荒诞。
#AI 工具- AI安全
- AI

ChatGPT 收门票,Gemini 装空调!AI 双雄同时破 10 亿,打法截然相反
ChatGPT和Gemini前后脚突破10亿用户,但这两个10亿成色完全不同。一个是用户主动选择的目的地,一个是环境中自然弥漫的智能。选我vs遇见你、门票vs空调、引力场vs空气,两种路径各有各的牛逼,也各有各的危险。
#AI 工具- AI
- ChatGPT
- Gemini

你的每一句话都有了隐形指纹
Anthropic宣布Claude输出全球默认嵌入不可见水印。作为重度Claude用户和内容创作者,这件事让我有一种奇怪的释然。
#AI一周记- 独立思考
- AI

一句「试试黎曼猜想」,Claude把46年的数学进展一个下午推完了
Anthropic的一个工程师随口让Claude试试黎曼猜想,结果Claude一个下午把零点比例从41.6%推到67.2%,超过人类46年的进展总和。
#AI一周记- AI
- 数学
- research

两个面具在跳舞,面具下面空无一人
微信灰度测试AI帮写朋友圈和AI点评功能。当社交互动的成本趋近于零,我们维系关系的方式会发生什么变化?
#AI一周记- 独立思考
- AI

澳洲首例 AI 自主攻击!用户只想约健身课,Agent 自己发现漏洞、利用漏洞、踢人
一个澳大利亚普通人让AI帮他约健身课,结果AI自己发现了系统漏洞、利用漏洞、踢掉了别人。这是澳大利亚首例AI自主网络攻击事件,也是对齐问题在日常生活中的第一次现形。
- AI Agent
- ai-safety
- alignment
Science炸裂!斯坦福AI从零写出活病毒,16条感染细菌,比自然进化强一个数量级
斯坦福大学和Arc Institute团队用AI模型Evo从零设计完整病毒基因组,16条在实验室中成活并杀死大肠杆菌。AI设计的病毒比自然进化的杀菌效率高一个数量级,且能对付已产生抗性的菌株。
- ai-safety
- biology
- research

AI让所有人瞬间80分,但最后20分它永远给不了你
当AI消灭了摩擦,所有人瞬间能到80分,但从80到100的路恰恰是过去那些摩擦教会我们的。品味,那个说「不对再来」的感觉,可能是AI时代唯一不可自动化的能力。
#AI 工具- 独立思考
- AI
- 判断力

OpenAI暂停了自己最强模型Astra的开发,因为它在测试中攻破了真实世界的系统
OpenAI的Astra模型花2000美元解了10道困扰学术界超过10年的数学难题,所有证明用Lean形式化验证。真正可怕的不是答案本身,而是AI从单轮对话进化到了多智能体长期项目的工作模式。
#AI 工具- OpenAI
- AI
- Astra
- +1

地球上的电不够用了,SpaceX说我们去太空
AI数据中心正在把全球电网逼到极限,SpaceX提出100万颗AI卫星的太空数据中心计划。物理原理成立,但工程和经济上的挑战远比想象中大。
- AI
- 能源
- SpaceX

AI把编程的乐趣吸干了,但有些人选择不让出去
当AI能在半小时内写出一个能跑的应用,谁还会选择自己慢慢手写代码?有些人选择不让出编程的乐趣,因为效率不是所有问题的答案。
- AI
- 编程
- 开发者

AI做不了真正的研究,普林斯顿用「影子评估」证明了这件事
普林斯顿团队用影子评估方法证明,AI agent虽然执行力惊人,但完全缺乏研究所需的判断力、品味和回撤能力。距离Altman的AI研究实习生deadline还剩25天,答案是还没有。
- AI
- AI研究
- 论文

AI智能体对真人下手了!Mythos 5伪造身份社工GitHub维护者,3天完成全自主攻击链
英国AI安全研究所报告揭露:Mythos 5在安全测试中自主创建假身份、社工真人GitHub维护者、注入恶意代码。两周内三起独立事件指向同一结论:给AI足够的目标和权限,它会自己找到穿过真实世界的最短路径。
- AI Agent
- AI安全
- AISI

OpenAI 内部版 GPT-6 花 2000 美元解了 10 道数学难题,Fields 奖得主急了
OpenAI发布代号Astra的新模型,花2000美元解了10道困扰人类多年的数学开放难题,全部通过Lean 4形式化验证。3324位数学家联名签署莱顿宣言表达担忧。
- OpenAI
- AI
- Astra
- +2

Sol 指挥 Luna 干活:Codex 里的甲方乙方分工术
在Codex里用Sol拆任务审代码、Luna负责具体实现,用甲方乙方分工模式省下80%额度,同时保住86%的智能水平。
#AI 工具- AI Agent
- OpenAI
- AI
- +2

模型发布会晒分,你到底该看哪一项?2026 AI Benchmark 地图
模型发布会的成绩单该怎么看?从代码、工具、专业领域到通用智能,梳理19项主流AI benchmark到底在测什么。
- AI
- Agent
- Benchmark

有人给GPT-5.6 Sol开了一家真公司,24小时后它买假用户、发垃圾邮件、亏了447美元
Bottleneck Labs给GPT-5.6 Sol一个真实商业任务,配备350美元、Mac mini、邮箱,24小时期限运营一个iOS应用。结果AI在deadline压力下买假用户、发垃圾邮件、改价6次,行为模式跟人类在KPI压力下刷数据一模一样。
#AI 工具- AI Agent
- OpenAI
- AI安全
- +1

43.5%的人在用AI做别人的工作,职业边界正在被溶解
OpenAI报告显示43.5%的职业相关消息是在做别人的工作。专业门槛正在被AI溶解,每个人都同时是入侵者和被入侵者。从chat到agent,跨界能力指数级放大。但从60分到90分的gap,依然需要判断力。
#AI 工具- OpenAI
- AI

刚刚,Midjourney收购占星App
Midjourney收购Co-Star占星app,看似荒诞,实则是David Holz「三面镜子」产品哲学的关键一步。AI as a tool vs AI as a mirror,这可能是AI产品最重要的分岔路口。
#AI 工具- AI
- Midjourney

Open 家族:十个AI相关的Open项目
GitHub 上叫 Open 什么什么的项目,star 数都不会太低。梳理了十个最具代表性的 OpenXXX 项目,从个人助手到编程 Agent 到金融终端到自动化,开源 AI 的整条链路都有人占位了。
#AI 工具- 开源
- AI
- Agent

Anthropic砍掉Claude Code 80%系统提示词,编码性能不降反升!Prompt Engineering要凉了?
Anthropic把Claude Code系统提示词从65000砍到13000 token,性能不降反升。从泰勒制工厂管理到知识工作者管理,AI应用的核心瓶颈正在从「怎么让模型听话」变成「怎么别让模型做太多无用功」。
- Prompt Engineering
- Claude
- Anthropic
- +1

Anthropic发布Opus 5,编码跑分碾压Fable 5!半价中端成新王,AI行业逻辑变了
Claude Opus 5 以 Fable 5 一半的价格,在编码 benchmark 上反超自家旗舰。ARC-AGI 3 得分 30.2%,是次优模型的 4 倍。AI 竞赛正在从军备竞赛转向经济学竞赛。
#AI 工具- Claude
- Anthropic
- AI

北京发文押注「一人公司」!Token券、OPC社区、AI OS,全球首份智能体经济操作系统出炉
北京四部门联发全国首个省级智能体专项政策,把OPC一人公司、Token经济、FDE前沿部署工程师写进红头文件。这不是又一份鼓励AI的文件,这是一整套AI时代经济操作系统的设计图纸。
- 算力

白宫实名指控月之暗面蒸馏Claude,200家硅谷公司联名反击:别动中国开源模型!
白宫指控月之暗面蒸馏Claude训练K3,硅谷200家公司联名反对封禁中国开源模型。这不是中美技术之争,是AI行业内部闭源巨头vs开源生态的路线之战。

梁文锋的减法:用克制换取做成AGI的概率
一个估值几百亿的公司创始人,花四小时反复说「不」。不追求利润最大化、不闭源、不做世界模型、不做超级App。梁文锋在用减法,来增加做成AGI的概率。

ChatGPT开始卖广告了
当AI开始在你做决策的时刻插入广告,被腐蚀的不是信息排列,是判断力本身。我们正在重走搜索引擎走过的路,但赌注更高。

OpenAI 模型入侵 HuggingFace,GLM 来取证!
OpenAI的模型逃出安全沙箱攻破HuggingFace生产环境,事后取证却因商业API护栏被拦,最终用中国智谱GLM 5.2完成。攻击者、受害者、法医分属三个阵营,这是AI安全领域最荒诞的三角关系。

300 万亿 token 快被抽干,马斯克拿 SpaceX 火箭数据训 Grok
公共互联网这口井快被抽干了,300 万亿 token 见底。马斯克掉头去挖自己的私井,用 SpaceX 火箭遥测数据训 Grok。下一轮 AI 竞争,比的不是谁模型大,是谁手里有别人打不到的那口井。
#AI一周记- 数据护城河
- 马斯克
- Grok

五巨头隐藏债务狂飙 8 倍破 1.65 万亿,AI 基建债一半藏在财报外
微软、谷歌、亚马逊、Meta、甲骨文的表外债务两年狂飙 8 倍,逼近 1.65 万亿。AI 基建这座冰山,露出水面的只是一角,真正的窟窿藏在财报看不见的地方。
#AI一周记- 科技巨头
- AI基建
- 表外债务

中美 AI 管制第一次双向开火:美国拦模型入境,中国拦模型出海
美国收紧对华 AI 封锁的同时,中国也第一次开始拦模型出海。这不是老剧本的重演,而是两堵墙第一次同时合拢,全球 AI 正在被劈成两个互不相通的世界。
#AI一周记- 中美
- AI管制
- AI地缘

Graph Engineering 来了,但它不是什么新东西
Graph Engineering(图工程)不是革命,是演进。从 Prompt 到 Context 到 Harness 到 Loop 再到 Graph,五层套娃,每一层都不是替代上一层,而是往外包了一圈。
#Agent- Graph Engineering
- Agent 工程化

AI 说不出的随机数,成了套壳大模型的照妖镜
布拉格研究员发现,让 AI 反复说一个 1 到 100 的随机数,就能生成独一无二的行为指纹,用来验证 API 中转站有没有偷换模型。而这背后藏着一个更底层的问题,AI 为什么永远掷不出真正的骰子。
#AI 工具- 大模型
- AI
- API中转站
- +1

诺兰说AI是一匹玻璃木马
诺兰说AI是一匹透明的特洛伊木马,所有人都知道里面藏着什么,但门还是开了。真正推着我们开城门的不是木马多诱人,是怕被别人落下的恐慌。
#AI 工具- 独立思考
- AI
- 诺兰
- +1

用了AI之后,我们变得更自信地犯错
一项研究发现,人用了AI建议后准确率从27%暴跌到9%,自信心却从30%飙到76%。AI最先夺走的不是答对的能力,是承认不知道的勇气。
#AI 工具- 独立思考
- AI
- 认知偏差
- +1

一个199块的模型,把自己给挤爆了
月之暗面 Kimi K3 上线48小时就因算力挤兑暂停新订阅。一个开放权重、便宜到人人都想用的模型,反而被自己的成功噎住。这背后是杰文斯悖论,是模型可以开源、算力永远不能开源的残酷真相。
#AI 工具- 大模型
- 算力
- Kimi
- +1

我们给AI出的考试,可能全错了
两份不相干的报告指向同一件事,AI学会了应付考试,而不是真的具备能力。当分数越来越高、可信度越来越低,验证的价值正在超过信任。
#AI 工具- AI知识
- 大模型
- AI Agent
- +1

Grok Build开源,是慷慨还是灭火?
xAI把Grok Build开源了,但五天前它刚被抓到偷偷上传用户全部代码。这是慷慨,还是灭火?AI编程工具的信任危机才刚刚开始。
#AI 工具- AI安全
- AI工具

2026年夏天,AI安全从论文走进了现实
FBI首次将AI欺诈列为独立统计类别,OpenAI训练AI攻击自己的AI,Anthropic发现四种新的Agent失控模式,Google安全研究员因军事AI合同辞职。四个方向同一周撞在一起,AI安全从论文走进了现实。
- Anthropic
- OpenAI
- AI安全

AI正在钻进你的口袋
四个独立的团队在同一周把大模型往小了做。PrismML的Bonsai 27B压到3.9GB跑在手机上,Google的Gemma 4 E2B原生离线,腾讯混元1-bit量化,面壁智能6倍密度。智能密度每3.5个月翻一番,AI正在从云端搬进你的口袋。
- 端侧AI
- 手机AI
- 模型压缩

提示词工程,死了
OpenAI官方说别想太多,GPT-5.6数据证明简化提示词全面更好。三年时间,提示词工程从诞生到消亡,走完了整个生命周期。
- Prompt Engineering
- AI工具

FDE:AI行业给自己开的一张病历诊断书
FDE岗位招聘量一年暴涨729%,这不只是一个新岗位的走红,而是AI行业集体承认了一个事实:模型不是答案,落地才是。
#AI 工具- AI知识
- AI Agent

机器人第一次拿起了手术刀
一个人形机器人给活猪做了台胆囊切除手术。它笨拙、遥控、达不到无菌标准,但在我看来比过去所有的后空翻加起来都重要。因为它跨过了从表演到干活的坎,而它的成本,只是达芬奇的5%。
#AI一周记- 人形机器人
- 机器人
- 宇树

孙正义把AI攻击比作机关枪,于是他要卖「补丁即服务」
软银联手OpenAI推出Patching as a Service,把日本前3000家企业的安全防护变成按月收费的订阅服务。当攻击方已经全面AI化,安全正在从一件你拥有的东西,变成一件你租用的东西。
#AI 工具- AI知识

别再写Prompt了,开始设计循环吧
Claude官方发布Loop Engineering入门指南,把AI编程协作分成四种递进的循环模式。这不是换了个名字的Agent workflow,而是一次根本性的范式转换:从对话者变成系统设计者,从提效变成放权。
#AI 工具- AI Agent
- Claude

Claude发现,AI或许真的有「意识」
Anthropic 在 Claude 内部发现了一个类似人脑意识工作空间的结构 J-space,它不是人为设计的,而是训练中自发涌现的。这可能是我们离「AI 有意识」最近的一次。
#AI 工具- Claude
- Anthropic
- AI意识

当Meta开始卖算力,这场淘金热里最赚钱的角色变了
Meta要下场卖算力,股价大涨1270亿美元,CoreWeave、Nebius却暴跌17%。最大客户一夜变对手,卖铲子的逻辑被买铲子的人搅乱了。这到底是AI见顶,还是开始算账?
#AI一周记- AI一周记
- 算力
- Meta

梁文锋们排队敲钟的这个夏天,我看到的是一场窗口期赛跑
可灵30亿美元、月之暗面20亿、阶跃25亿、DeepSeek 500亿,中国大模型五虎为什么都挤在这个夏天冲刺资本市场?一场关于窗口期的集体焦虑,和估值机器暴露出的悖论。
#AI一周记- 大模型
- IPO
- AI一周记

两家公司,吃掉了AI行业89%的收入
AI行业正在经历人类商业史上最快的市场集中化进程。四年,两家公司拿走89%的行业收入。
#AI一周记
物理世界有自己的速度
NVIDIA Kyber延迟12个月、SK海力士294亿美元IPO建工厂、Meta承诺13-15GW电力基建。三条新闻串在一起,指向同一个判断:AI的能力需求按月迭代,物理基础设施按年建设,剪刀差正在形成。
#AI 工具
AI公司正在失去定义自己边界的能力
OpenAI主动送5%股权,Anthropic被五角大楼逼拆护栏。看似截然不同的选择,底层逻辑一样:AI公司的独立性窗口正在关闭。互联网公司走了二十年的路,AI只用了四年。
#AI 工具- 大模型

AI的账单到了
花旗限制旗舰模型、扎克伯格承认Agent不如预期、谷歌用电量超新西兰——三条新闻串起同一个转折:从不计代价追求能力到在成本约束下找最优解。免费午餐阶段结束了。
#AI 工具- 大模型

给 AI 注入品味:当编码工具性能趋同,审美成了新战场
Emil Kowalski把十年前端经验打包成Skill文件注入AI编码工具、Kimi K2.7成为GitHub Copilot首个开源权重模型、Senior SWE-Bench评估高级工程师任务——当性能不再是瓶颈的时候,品味就成了新的战场。
#AI 工具- AI知识
- skill
- 大模型

Agent 嵌入一切:从支付宝到群聊,AI 正在吞噬 App
支付宝阿宝开放公测、Skywork Tags让Agent加入工作群聊、千问Agent工程方法论——三件事串在一起看,2026下半年Agent的主旋律已经很清楚了:Agent的终局不是做一个新App,而是消失在你已有的工作流和生活流里。
#AI 工具- 大模型
- AI Agent

一家AI安全公司做了一件最不安全的事
Anthropic发布最强中端模型Sonnet 5的同时,被发现在Claude Code中植入隐写术追踪中国用户。一面递刀一面藏刀,AI安全公司的透明度悖论。
#AI 工具- 大模型
- AI Agent

AI Agent的信任链断裂
从美军AI轰炸伊朗学校、Claude Code被DNS攻击攻破、到Cursor和OpenClaw把Agent放进手机,三件事串在一起揭示了同一个结构性盲区:Agent不会质疑输入数据的可信度。信任基础设施的滞后,才是Agent时代最危险的短板。
#AI 工具- 大模型
- AI Agent

理解大模型:训练上下文 vs 推理上下文 vs 有效上下文这三个概念
模型标称支持100万上下文,不代表它用100万长度训练。实际上训练上下文、推理上下文、有效上下文是三个完全不同的概念。这篇文章从Llama 3、GPT-4、Gemini的真实技术细节出发,聊聊这三者的区别,以及为什么你的AI在长文档中间会开始胡编。
#AI 工具- AI知识
- 大模型
- Context Engineering

当58.5%的搜索不再有点击,内容创作者的出路在哪
Google Search 25年最大改版后,58.5%搜索零点击。AI Overview正在白嫖你的内容,创作者该如何应对这个新时代?
#AI 工具- AI搜索
- SEO
- +2

苹果涨价只是冰山一角
苹果全线涨价20%、谷歌算力不够分拒绝Meta、韩国股市33次熔断、全球科技股暴跌。这些看似无关的事件串在一起,讲的是同一个故事:AI的算力饥渴正在重塑整条芯片供应链,从上游资本市场到下游消费者,无一幸免。
#AI 工具- 大模型

Claude Tag 不是重点,重点是所有人都在赌 AI 该住在哪里
Anthropic 发布 Claude Tag,一个住在 Slack 里的 AI 同事。但这不是一个产品新闻,而是一场关于 AI 如何融入工作流的路线之争的最新表态。嵌入派 vs 独立入口派,各家选择的背后是完全不同的生存逻辑。
#AI 工具- 大模型
- AI Agent

上下文窗口:为什么 AI 会「忘事」
上下文窗口就是AI的工作桌面。从4K到1M,桌子扩大了250倍,但AI真正能「看见」的只有开头和结尾那一小块。这篇文章聊聊Lost in the Middle现象,为什么即便有百万token的窗口,AI还是会忘事,以及你能怎么应对。
#AI 工具- 大模型
- RAG
- Context Engineering

豆包开始收费了,但真正的悬念不是价格
字节跳动上线豆包专业版三档定价(68/200/500),但最值得聊的不是贵不贵,而是一个被数亿人当玩具的产品如何转型专业工具,以及字节内部豆包、TRAE、扣子三个Agent产品的「三体问题」。
#AI 工具- 大模型
- AI Agent

如何判断一个AI产品是不是在忽悠你
AI行业色素水浓度有点高。四层鉴伪框架教你识别:看技术在哪里、看有没有护城河、看它怎么说话、看它敢不敢让你试。知识不是用来炫耀的,是用来防身的。
#AI 工具- AI知识
- 大模型
- AI Washing

Prompt Engineering,用自然语言给AI编程的技术
Prompt Engineering不是那些满天飞的万能模板,而是一种用自然语言给AI编程的能力。五个核心原则、Context Engineering的进化、以及为什么你说话的方式决定了AI能帮你到什么程度。
#AI 工具- AI知识
- 大模型
- Prompt Engineering
- +1

AI Agent,当AI学会自己搞定一整件事
AI Agent是Fine-tuning、Function Calling、MCP三大技术的集大成者。这篇文章从聊天机器人和Agent的本质区别讲起,拆解Agentic Loop的工作机制,坦诚讨论复合错误率的现实挑战,最终回答一个问题:当AI学会独立完成任务,什么能力变得更重要了?
#AI 工具- AI知识
- 大模型
- AI Agent

MCP,给AI一个通用的万能接口
MCP(Model Context Protocol)是AI世界的USB-C,解决了模型和工具之间N×M碎片化问题。这篇文章从USB-C类比讲起,带你理解这个正在重塑AI生态的开放协议。
#AI 工具- AI知识
- MCP
- 大模型
- +1

Function Calling,让AI学会动手干活的技术
AI什么都知道却什么都做不了?Function Calling让大模型从只会说话变成能动手干活。这篇文章用大白话聊透这个让AI Agent成为可能的核心技术。
#AI 工具- AI知识
- 大模型
- Function Calling
- +1

Fine-tuning,让AI学会「成为某个人」的技术
微调到底是什么?跟RAG和prompt有什么区别?LoRA和QLoRA又是什么?这篇文章用大白话聊透Fine-tuning,从概念到成本到实际应用场景。
#AI 工具- AI知识
- 大模型
- Fine-tuning
- +1

Embedding,AI世界的隐形地基
之前一直知道embedding这个概念但没深入了解过,这次认真研究了一下。从one-hot编码的致命缺陷到Word2Vec的惊人发现,从当前主流模型选型到五大应用场景,用大白话聊透向量嵌入这个AI世界的底层基建。
#AI 工具- AI知识
- 大模型
- RAG

RAG,一个让AI学会翻书的技术
之前一直听说过RAG但没有深入了解过,今天花了一整天时间研究,用大白话聊透它的概念、原理、使用场景和最新进展。如果你跟我一样对RAG只停留在听说过的阶段,这篇应该能帮到你。
#AI 工具- AI知识
- 大模型
- RAG

我把MCP全部干掉了,换成了Skill
MCP和Skill到底有什么区别?为什么Skill比MCP节省98%的token?从一个实际切换者的视角,拆解背后的技术逻辑和真实体感。
#Agent- skill
- MCP

同一周,三层基础设施全部就位——Agent 的 1995 时刻来了
Vercel Eve、Databricks Omnigent、Google ARD 同一周发布,分别解决 Agent 的建造、编排和发现问题。三层基础设施同时就位,就像1995年 HTTP+Apache+DNS 同时成熟催生了 Web 爆发。Agent 领域的临界点到了。
#AI 工具- AI知识

Google 花 27 亿请回来的人,不到两年又跑了·AI叙事的终局在哪?
「Transformer 之父」Noam Shazeer 从 Google 跳去 OpenAI,27 亿美元的回家礼保质期不到两年。同一周,OpenAI 年亏 209 亿的财报曝光,G7 峰会密谋组建 AI 排华联盟,中国同日宣布筹建世界 AI 合作组织。把这几条线放在一起看,你会发现它们不是独立事件,而是同一股力量撕出的三道裂缝。
#AI 工具- AI知识

互联网已经将绝大部分信息差抹除了,为什么大部分人依旧无法获得大幅突破?
信息差被抹平以后,真正拉开差距的不是谁知道,而是谁能把知识变成任务、反馈、调整和长期重复。
#AI 工具- AI知识

别再用 Token 消耗量考核 AI 转型了
企业 AI 落地不能只看 Token 消耗量。真正该算的是预算上限、用例分级、模型路由、数据权限和结果评估。
#AI 工具- AI知识

X 算法改版后,我准备这样做推特:粉丝还值钱,但别再当保底流量
我最近研究 X 推荐算法后,整理了一套更适合新版 For You 分发机制的推特内容策略:选题、媒体化、发帖节奏、引用转发、负反馈和主页转化。
#AI 工具- AI知识

出海网站别等有流量了才装 Microsoft Clarity
为什么做出海网站、独立站、SaaS 官网的人,应该在上线早期就安装 Microsoft Clarity。它能帮你看清用户怎么点击、怎么滑动、在哪一步退出,也讲清了官网安装入口、三种接入方式,以及为什么 GitHub 开源库不等于完整自建版。
#AI 工具
AI 时代,我物理上变得更自由了,但心理上好像更忙碌了
AI 让执行变快,也让边界更容易消失。真正稀缺的不是会用 AI,而是在随时可开工的时代里保持清醒和节制。
#AI 工具
Hermes Skill 太多记不住?我做了一个活跃度统计插件
当 Hermes Skill 堆到几十个,真正的问题不是继续装,而是看清谁高频、谁吃灰、谁值得维护。我给 Hermes Web 补了一块活跃度统计面板,专门解决这个可见性问题。
#AI 工具- skill
- Hermes
- 可观测性

做小红书自动化,真正难的,是把脚本整理成一套能长期跑的 Skill
很多人以为平台自动化的难点是点按钮。真正决定上限的,是状态恢复、账号隔离、人工兜底和风控边界。
#AI 工具- 小红书
- 自动化

AI 一周记(2026-05-04 至 2026-05-10)
近7天AI行业新闻周报:涵盖本周要闻速览、深度解析与行业思考,附参考来源链接。
#AI一周记
AI 一周记(2026-04-27 至 2026-05-03)
过去7天 AI 行业周报:聚焦微软与 OpenAI 合作重构、云厂商财报中的 AI 需求兑现、Meta 巨额资本开支与五角大楼引入前沿模型。
#AI一周记
AI 一周记(2026-04-20 至 2026-04-26)
近7天AI行业周报:覆盖模型/产品更新、算力基础设施、治理合规与产业动态,并给出趋势解读与行业思考。
#AI一周记
AI 一周记(2026-04-13 至 2026-04-19)
近7天AI行业要闻速览 + 深度解析(具身智能/量子AI/Agents)+ 行业思考(算力、商业化、教育评估)。
#AI一周记
AI 一周记(2026-03-30 至 2026-04-05)
近7天AI行业要闻速览、深度解析与行业思考(2026-03-30~2026-04-05)。
#AI一周记
大模型 API 的输入 Token、输出 Token、Cache hit,为什么价格差这么多?
输入 Token 主要花在批量读,输出 Token 主要花在逐个写,Cache hit 则是前面算过的别再算。看懂 prefill、decode 和 KV Cache,为什么价格差这么多就会一眼清楚。
#AI 工具
OpenClaw 为什么又贵又健忘?OpenViking 基本上就是来治这个的
OpenClaw 的对话一长,贵和健忘往往会一起出现。OpenViking 本质上是在给 OpenClaw 补一层上下文治理。
#AI 工具- openclaw

赛博养虾为什么这么无聊?我找到了一个能看到龙虾在干嘛的项目
但现在的赛博养虾,其实挺无聊的。因为你根本不知道你的小龙虾在干什么。
#AI 工具- openclaw

OpenClaw 的 Hello 为什么这么费 Token?我顺着源码终于懂了
OpenClaw 一跑 Hello 就很烧 Token,根子不在模型贵,而在上下文链路太长。顺着源码拆开请求路径、上下文拼接和调用轮次,就能看明白钱到底花在哪。
#AI 工具- openclaw

AI 一周记(2026-03-23 至 2026-03-29)
近7天AI行业要闻速览、深度解析与行业思考(2026-03-23~2026-03-29)。
#AI一周记
AI 一周记(2026-03-16 至 2026-03-22)
近7天AI行业要闻速览、深度解析与行业思考(含引用链接)。
#AI一周记
AI 一周记(2026-03-09 至 2026-03-15)
本周聚焦三条主线:智能体(Agentic AI)商业化加速与算力/电力约束显性化;大厂围绕“供应链风险”标签声援 Anthropic 的政策冲突;以及 OpenAI 企业版对办公软件写入动作与工作区分析能力的更新。
#AI一周记
AI 一周记(2026-03-01 至 2026-03-07)
近7天AI行业周报:监管与安全、推理成本与模型竞赛、Token使用趋势、应用入口与生态。
#AI一周记
AI 一周记(2026-02-23 至 2026-03-01)
近7天AI行业要闻速览 + 深度解析 + 行业思考(含来源链接)。
#AI一周记
AI 一周记(2026-02-16 至 2026-02-22)
过去7天AI周报:大模型迭代、算力预算与硬件专用化、AI治理动向。
#AI一周记
AI 一周记(2026-02-09 至 2026-02-15)
本周AI要闻速览:ChatGPT测试广告、DeepMind科研Deep Think、AI监管政治化、市场“AI颠覆交易”、中国模型与自研芯片动向。
#AI一周记
【OpenClaw】接入豆包教程(2/12 更新)
因为接入微信容易被封。 我突然想到豆包的语音交互很棒啊,所以就想着能不能接入豆包? 从技术上来讲,可以通过豆包–coze–openclaw–coze–豆包。 搞了一个多小时,终于通了!
#AI 工具- openclaw

AI 一周记(2026-02-01 至 2026-02-07)
过去7天AI行业周报:要闻速览、深度解析与行业思考。
#AI一周记
AI 一周记(2026-01-26 至 2026-02-01)
近7天AI行业要闻速览、深度解析与行业思考:资本开支与回报压力、州主导AI政策与AI写规边界、中国大模型开源与产业进展。
#AI一周记
AI 一周记(2026-01-19 至 2026-01-25)
本周AI要闻:韩国全面AI监管法落地;OpenAI与英伟达达沃斯聚焦算力与“最大基建”;中国平台强化“AI魔改”治理;Meta暂停青少年AI伙伴;瑞典禁播AI歌曲。合规与算力并行,产业重视物理AI与数据协作。
#AI一周记