标签:ai-tooling
AI 抬高了下限,评分标准还在惩罚上限
🎙️ yage.ai
9/7/2026
📄 文章通过两项随机对照实验,探讨了AI在学习和作业中的影响,核心观点在于AI工具能够有效抬高作业的下限,但如果评分标准只奖励流畅的套路,反而会压制学生对深度思考和探索边界的训练。文章强调,关键在于重构评价体系,引导评价重心从单方面奖赏标准答案转向鼓励检验前提假设、推导因果机制和探索非常规方案,从而真正训练人的认知上限。
管道不是产品:Salesforce
把同一套接口发了两次,只有一次有人理
🎙️ yage.ai
9/1/2026
📄 文章探讨了软件厂商在为 AI agent 时代提供接口时,从最初的裸露接口(如 Salesforce 的 Headless 360)到最终封装成完整产品(如 Salesforce in Claude)的演进过程。核心观点是,真正促成企业采用的关键不在于底层接口本身,而在于对业务语义的深度封装、管理运维的整装打包以及终端分发的深度绑定,这三层能力构成了 agent 时代软件落地的最小采用单元。
「豆包工作」现教现学:从一份日文 PDF 到官网、视频、PPT 全搞定,打通飞书后太爽了! · 乔木博客
🎙️ 向阳乔木
8/24/2026
📄 文章介绍了字节跳动推出的「豆包工作」Agent产品,该产品通过与飞书的打通,实现了从处理日文PDF文档到生成官网、社交媒体素材、视频宣传片、PPT制作等全流程的生产力场景自动化。核心亮点在于Agent能够理解企业上下文,并能与飞书的组织结构、文档、会议纪要等深度结合,实现跨工具的协作和任务流自动化,极大地提升了传统企业在AI落地时的效率和执行力。
豆包更新了工作模式,正面硬刚 Workbuddy · 乔木博客
🎙️ 向阳乔木
8/17/2026
📄 文章介绍了豆包客户端更新后的工作模式,重点展示了其在AI办公场景中的强大能力,如集成Office和飞书套件、支持本地和云端电脑、以及通过Agent实现定时更新论文学习网、生成互动课件、制作PPT和Vlog等多种复杂任务。作者强调了豆包工作模式的实用性,并指出Agent是实现高效办公的关键,云电脑模式提供了7*24小时的无缝工作体验。
Google 发布
DiffusionGemma:当语言模型不再只能从左到右写
🎙️ yage.ai
8/16/2026
📄 Google 发布了开源模型 DiffusionGemma,它通过将自回归生成过程改写为在固定画布内通过多轮双向注意力迭代去噪的并行生成机制,实现了文本生成速度的提升。该模型在推理加速和复杂推理能力之间进行了权衡,并展示了在特定负载下的性能取舍,为未来文本生成架构提供了新的工程实践方向。
二次元头像=技术大佬?DeepSeek Harness揭开AI圈隐藏规律 · 乔木博客
🎙️ 向阳乔木
8/15/2026
📄 文章介绍了 DeepSeek 发布了 DeepSeek Harness (DSH),一个让模型能作为 Agent 的外壳框架。DSH 的核心理念是“一切皆插件”,允许用户通过插件来扩展模型的工具、技能和功能。文章重点展示了 DSH 社区的快速发展,以及通过 'Colleague-skill' 和 'OpenBiliClaw' 等热门插件,如何将模型能力转化为实际工作技能和信息获取工具,体现了开源生态的活力和用户驱动的创新。
你纠正了 AI 十几次,它为什么还是记不住
🎙️ yage.ai
8/12/2026
📄 文章探讨了AI在记忆和经验固化方面的局限性,指出AI记不住要求或经验的关键不在于模型智商或措辞,而在于经验的存放位置。作者提出了经验的四层结构(对话上下文、外部记忆、项目版本化文档、模型微调),并建议根据经验的性质选择最合适的落点,强调先外化再执行的策略,以平衡风险和成本。
如何选购房屋所有者保险:防范灾难的终极指南
📝
🎙️ New York Times Podcasts
7/31/2026
📄 本期访谈探讨了房屋所有者保险(Homeowners Insurance)的核心要点。通过洛杉矶野火受灾作者的亲身经历,详细解析了足额投保、实际现金价值(ACV)与重置成本价值(RCV)的区别、如何利用 AI 辅助解读条款,以及预防保单断签和降低保费的具体策略。
K3 用早期的自己优化了自己,这比 2.8 万亿参数更值得琢磨 · 乔木博客
🎙️ 向阳乔木
7/27/2026
📄 文章探讨了Kimi K3模型在开源领域的核心价值,强调其不仅体现在参数规模(2.8万亿)上,更在于其在模型优化自身训练基础设施和底层代码(如GPU kernel优化、自建编译器)方面的能力。核心观点是,模型开始成为训练自身基础设施的贡献者,这种自我指涉的循环是其持续领跑的真正原因,标志着AI范式正从单纯的模型性能竞赛转向模型对生产系统的优化能力。
香港直播开场与生活体验:从身体状况到知识工作流的深度拆解
📝
🎙️ 魏知超啥书都读
7/13/2026
📄 文章记录了一次简陋的香港直播经历,内容涵盖了作者因近视老花问题、对香港文化的深厚感情、读书方法(AI辅助选书)、节目制作全流程以及对人工智能发展趋势的思考。核心在于分享个人经验和知识管理工作流。
一文看懂ChatGPT、Codex、Work 的差别 | 宝玉的分享
🎙️ baoyu.io
7/11/2026
📄 本文对比了 ChatGPT、Work 和 Codex 三种模式的核心区别。Chat 用于快速问答和讨论,Work 侧重于跨应用完成知识工作流的自动化交付;Codex 则专注于在代码仓库中进行软件开发任务(如修改代码、提交 PR)。文章详细解释了这三种模式的使用场景、数据读取方式以及它们之间的额度共享机制,并对比了 Work 与 Claude Cowork 在桌面端执行架构和跨设备同步上的差异。
AI 恐慌是一场租金保卫战:从骂何同学说起
🎙️ yage.ai
7/5/2026
📄 文章探讨了AI工具平价化对传统手艺和知识工作者判断力的冲击,引发了一场关于‘租金保卫战’的道德抗议。作者通过对比天文摄影、写作等领域,分析了新工具如何将执行层的手艺贬值,而高价值的判断力则被外包给AI。文章最终指出,真正的核心在于区分‘手艺’(可被工具替代)和‘判断力’(决定方向的能力),并强调在新的经济结构中,独立判断力和对大众传播规律的洞察力才是稀缺的价值所在。
当执行力开始贬值:最会用 AI 的那批人,可能被 AI
伤得最深
🎙️ yage.ai
6/19/2026
📄 文章探讨了在高度依赖 AI 提升产出的环境下,过度依赖 AI 执行力可能导致职业判断力的贬值。核心观点是,当“让 AI 做一下”的低摩擦选项扩散为默认行为时,团队成员会逐渐丧失对价值判断的频率和能力。作者强调,真正的复利资产在于拒绝执行层面的无意义任务,并刻意留出思考方向的精力,以对抗被 AI 放大执行力的系统性退化循环。
李笑来《The Half Second》:你戒不掉的坏习惯,不是因为你软弱 · 乔木博客
🎙️ 向阳乔木
6/14/2026
📄 本文解读李笑来著作《The Half Second》,核心观点是行为改变并非意志力问题,而是工具使用错误。作者提出通过将行为改变降维为物理题,利用大脑的“频率计数器”机制,强调持续重复针对身体动作的脚本(而非情绪肯定语)的重要性。关键在于绕过意识审查,让行动在无意识中执行,并坚持直到抗议感转化为烦躁感。
弥合上下文鸿沟:Supabase 关于 MCP 与 AI Skill 协同实战录
📝
🎙️ AI Engineer
5/15/2026
📄 本文深入探讨了在 AI 代理开发中,如何结合模型上下文协议(MCP)与 AI 技能(Skill)来提升任务执行的准确性。Supabase 的实践表明,单纯的工具集成不足以应对复杂逻辑,开发者需通过“防跳过”指令设计和主观导向的工作流,引导 AI 遵循安全规范并利用现有文档。文章还分享了通过量化评估验证该方案有效性的具体数据。
创意工具的 Agent 化:从 Photoshop Action 到 Claude for
Creative Work
🎙️ yage.ai
4/28/2026
📄 文章分析了 AI Agent 在创意工具演进的三代历程,从脚本集成到闭环感知。Anthropic 的 Claude for Creative Work 代表了最新一代产品,解决了执行摩擦。瓶颈在于 AI 的视觉感知和评估能力,而非智力。未来 AI 将自动化非创意任务,人类角色更侧重创意方向与审美判断。
Intercom 如何通过 AI 工具将工程效率提升两倍
📝
🎙️ How I AI
4/20/2026
📄 本次访谈深入探讨了 Intercom 如何通过引入 AI 工具(特别是 Claude Code)将其工程吞吐量提高了一倍。Intercom 的高级首席工程师 Brian Scanland 分享了他们在此过程中的经验,重点介绍了文化变革、AI 技能采用的遥测技术重要性,以及对产品质量和开发者体验的影响。讨论还涉及了 AI 使用的成本考量,以及 AI 如何改变产品开发和内部流程。
编程智能体的核心组件【译】 | 宝玉的分享
🎙️ baoyu.io
4/5/2026
📄 本文深入剖析了编程智能体(Coding Agent)及其配套的运行框架(Coding Harness)的核心组件。文章区分了大语言模型、推理模型与智能体,并阐述了 Harness 如何通过代码库上下文、提示词缓存、工具调用、上下文瘦身、会话记忆及任务委派等功能,极大地增强 LLM 在软件开发中的实用性。作者以其开源项目 Mini Coding Agent 和 Claude Code、Codex CLI 为例进行说明。