Al焚书筑梦:大模型的数据围猎
今天有个词条上热搜了——AI焚书。 由于互联网充斥着大量AI生成的“垃圾信息”,领头企业如Anthropic开始大量收购纸质旧书,尤其是2022年之前出版的作品,以确保数据的纯净度。 为了规避版权诉讼并提高效率,这些公司利用工业机械切除书脊
阅读全文 →这里保留内容的自然生长顺序,也是全站最完整的思考记录。可以按栏目进入某条长期线索,或沿系列顺序连续阅读。
今天有个词条上热搜了——AI焚书。 由于互联网充斥着大量AI生成的“垃圾信息”,领头企业如Anthropic开始大量收购纸质旧书,尤其是2022年之前出版的作品,以确保数据的纯净度。 为了规避版权诉讼并提高效率,这些公司利用工业机械切除书脊
阅读全文 →“管理学的终点,是自我管理。” 今天思考的方向是管理学,为了解决当下繁杂的现状,工作、生活、兴趣、时间管理、注意力管理、项目管理、健康管理等等,仿佛周遭的一切都值得“管理”。 提到管理学,不得不提彼得·德鲁克,当年老师在管理学课上推荐过这位
阅读全文 →这几天AI圈最热的事,莫过于 Kimi K3 开源,以及黄仁勋发布的支持开源的公开信,这封信的名字叫《Open Weights and American AI Leadership》,开放权重与美国AI领导力。 紧接着,整个科技行业开始排队
阅读全文 →今天有个新思考,源自一个当下越来越常见的场景。 上午开创意会,一个同事一口气甩出来 4 套方案,全是AI生成了,方向没问题,但是内容太丰富了,太全面了,也太完整了,完整到我们没办法浏览完。 此外,还有同事用AI工具,一键生成了一份 30 页
阅读全文 →今天思考一个新的问题,到底怎么区分产品和服务? 有一种比较粗糙的说法是,“产品有形,服务无形”,但这么区分肯定不对,尤其是在现在越来越丰富抽象的商业世界中。 真正的分界其实只有一条,产品先生产后消费,可以库存,服务是生产与消费同时发生,无法
阅读全文 →前段时间因为智齿问题挂号北京大学口腔医院,听说这是全国最好的口腔医院,尝试了几次一直没能抢到号。 某书上也查了下,很多人都说这挂号比较难抢。但是研究的过程中,遇到一件值得琢磨的事。 医院居然有,普通部、特需部、国际部这个的划分,以前完全没意
阅读全文 →不是搞农业方面的创意,而是如何让创意像庄稼一样,源源不断一茬一茬的在一个农场里长出来。 这个想法,一点都不稀奇。 整个广告业过去六十年一直在干"把天才产能标准化"这件事,而且成功了。 最近一直有新的竞标业务,和行业里一位非常优秀的创意人一起
阅读全文 →这几天,到处流传一份梁文锋的投资者交流会录音实录,两万多字,未获本人确认。 我通读了一下。算力、芯片、定价,这些都是热闹。但整份内容里最让我感兴趣的是他关于 AGI 的观点。 AGI 就是所谓的通用人工智能,真正意义上的智能。 梁文锋说,A
阅读全文 →焦虑清单,又添了一项。 原本让人无限焦虑清单已经足够长了。 现在,它又多了一行,AI 订阅的额度。 每天要反复打开所有Agent 的订阅页面,看看额度还剩下多少,日子过的精打细算。 不知道这个月的额度够不够,也不知道每次点击会消耗多少,简单
阅读全文 →很多人第一次接触 AI 产品的定价,都会有一个小小的困惑。我已经买了 ChatGPT Plus,为什么用 API 还要再掏一次钱? 比如,我最近刚买 KimiK3 的订阅,订阅额度在 Kimi 客户端和 KimiCode 里用,但是我跟数字
阅读全文 →凌晨,做了一个噩梦。惊醒之后,想查查周公解梦。 然后我花了整整一个小时。搜索结果翻了一页又一页,前 100 多条,没有一个能用的网站。 要么是无穷无尽的广告弹窗,要么是 AI 生成的废话复读,要么是同一个内容被一百个域名互相抄袭,还有一个反
阅读全文 →上一版 v0.3 我写了 Cloud Self——这条路走到尽头,云里存的不再是软件,而是"你"。当时我在文末立了个 flag:v0.4 大概率会往"主动层"走,把 Agent 团队怎么脱敏地写进方法论。 这个 flag 我没兑现。因为这六
阅读全文 →个人数字基座是什么?这份V1.1白皮书系统解释个人数据主权、个人数据空间、个人智能体与数字身份,给出四层参考架构、五项判别标准、FAQ及演进路线。
阅读全文 →最近有个想法。 关于工作和生活边界界定的问题。 大家好像都在试图寻找一种解药,用来对抗那种被 KPI 和 OKR 钉死在工位上的窒息感。 这让我开始思考一个更底层的问题。 到底存不存在一种哲学,能彻底融会工作与生活,达到一种非常顺遂的境界?
阅读全文 →你以为你战胜了一个心魔,其实它只是暂时潜伏了。 距离我写下《增援未来:一个能改掉拖延症的人,在未来没有任何敌人!》,转眼三个月过去了;距离我宣称《大捷!治疗顽疾「拖延症」的第一战》,也过去了一段时间。 当时我觉得自己找到了“银弹”,掌握了“
阅读全文 →有一个越来越常见的现象。 很多人在长期高压、试图改变现状却屡屡碰壁之后,会进入一种诡异的状态,不是愤怒,也不是悲伤,而是一种深深的“无力感”和“幻灭感”。 一种倦怠,之前有本书叫《倦怠社会》,还没看,大概也是说过度自我驱动导致抑郁症、注意力
阅读全文 →【这是GavinMind的第230篇日更文章】 最近,我计划开始学习——数据库原理。 这并非突发奇想,而是出于一种对“失控”的恐惧。 目前,我的个人数字基座运转起来了,按计划后续会叠加非常多的功能和内容,工作、学习、个人管理相关的基本都会移
阅读全文 →有一个现象,经常“观察”股市的人可能都遇到过。 我们说「观察」,是因为操作有成本,血淋淋的教训历历在目。 当你手里有两只股票,一只赚了 20%,一只亏了 20%,你需要急用钱必须卖掉一只时,绝大多数人的第一反应是,卖掉那只赚钱的。 逻辑上讲
阅读全文 →昨晚我把数字基座的方法论 Freehold 推到了 v0.3,讲清了一件事:云里迟早存的不是软件,是你。方法论立住了,但方法论是空的,得有能跑的东西把它填实。 今天填了第一块:gleam,中文我给它取名「吉光片羽」。它是我用了几年的 flo
阅读全文 →三天前我把个人数字基座的方法论 Freehold 开源了,一句话立命:智能可以租,根基必须自有。 这三天我一直在想一个更狠的问题:如果这条路走到尽头,尽头长什么样? 今晚想通了,也把它写进了 v0.3。这篇文章照例说清三件事:这次更新了什么
阅读全文 →这几天网站后台出现了一条恶评。第一反应是生理性的不爽,紧接着,那个熟悉的“道德高地”陷阱又出现了,我想把它留着,当成警钟。 逻辑听起来很完美,“我要虚心接受批评,每天看着它提醒自己要兢兢业业,要做得更好。” 这种把自己架在“苦行僧”位置上的
阅读全文 →在在狭义相对论中有一个概念,叫光锥(Light Cone)。 这个概念用来描述时空因果结构的核心概念。 只有在未来光锥内的事件才能被「影响」,只有在过去光锥内的事件才能「影响」。这也是相对论中「因果律」的几何表示。 看起来似乎是个常识,但是
阅读全文 →两天前我把数字生命的方法论开源了,版本号 v0.1。 昨天一天,这套方法论在实践里被撞了三次。三次都撞出了新东西,其中一条 v0.1 里白纸黑字写着的原则,直接被推翻了。 今天发布 v0.2。这篇文章说清楚三件事:这次更新了什么、每一版分别
阅读全文 →今天看到了一个「空白画布思维」,觉得这个思维挺有意思的。 那么什么是空白画布思维呢? 字面意思,这是一种主动清空过去的经验,跳脱路径依赖,用开放的心态去面对未来与构建未来的认知能力。 它强调的不仅是从零开始,更是放下固有的框架,重新定义问题
阅读全文 →在之前的一篇文章中我说,AI能力是租来的,我们拥有的不是智能,只是一份可撤销的访问权。 写完那篇之后,一个更实际的问题一直追着我,既然智能注定是租的,那我们到底能拥有什么? 最近这周,我一直在自己的网站gavinmind.com 上做一件事
阅读全文 →上一篇我把个人数字基座的方法论开源了,名字叫Freehold,永业——智能可以租,根基必须自有。 文章发出去之后,有个问题自然而然浮上来:立起一块自己的领地之后,这块地上能长出什么? 我的答案,是一个数字生命。 过去这段时间,我一直在做一件
阅读全文 →上一篇我说,AI能力是租来的,我们拥有的不是智能,只是一份可撤销的访问权。 写完那篇之后,一个更实际的问题一直追着我:既然智能注定是租的,那我们到底能拥有什么? 这半年,我一直在自己的网站 gavinmind.com 上做一件事——把它从一
阅读全文 →《有限与无限的游戏:一个哲学家眼中的竞技世界》这本书表面上讲的是游戏,实际上讲的是文明、人生、组织、权力,甚至是一个人如何安放自己的问题。 书中有个很重要的界定,有限游戏是为了赢,无限游戏是为了让游戏继续。 这句话当然没有错,但如果只理解到
阅读全文 →这几天我越来越明确一件事。 个人网站真正重要的地方,已经不是展示自己了。 过去我们理解个人网站,通常会把它看成一个主页,一个作品集,一个博客,一个对外展示窗口。 它当然可以承担这些功能,但如果只停留在这一层,其实意义不大。因为展示这件事,第
阅读全文 →这段时间有点魔怔,我现在睁眼闭眼满脑子都是数字人、机器人、克隆人…… 今天,我要开始计划给数字人构建具体的身体了,没错,我要做个机器人,然后再跟我这些天构建的记忆系统对接起来。 我想要让数字Gavin,活过来! 也就是所谓的「具身化数字人」
阅读全文 →最近有一次跟客户吃饭,因为临近下班,高峰期,附近几家经典菜馆都要排队,一等就是两小时开外。 没想到,有个小伙伴直接在闲鱼上找了一个代排,很快就拿到了号。 我当时有点意外。以前只知道黄牛倒卖商品,没想到连排队的位置也可以买卖。 但仔细想想,代
阅读全文 →这两天,我从无到有,构建了一个数字人。 我把过去十多年的日记、文章、记忆和人生经历整理出来,先构建一个二十五岁左右的数字Gavin。 第一次和他对话时,非常震撼。 他知道我经历过什么,会使用我当时的语气,也能根据过去的材料回答一些我从未写过
阅读全文 →我的个人网站终于完成了新一轮迭代,正式上线。 域名和服务器其实早就准备好了,只是此前的网站只有一个粗糙的首页,一直没有认真维护。这几天,我主要使用 Claude Code 重新梳理了网站架构,调整了首页布局,也陆续增加了一些新功能。 整个过
阅读全文 →前段时间,美官方对Claude最新的Fable5和Mythos5实施出口管制,直到限制解除,模型才重新开放。 这几天,Fable5重新开放,但是一周以后会换成API调用的形式,于是大家都在“猛蹬”,想在这几天之内榨干Fable5的全部额度,最大化的助力到自己的业务当中来。 其实,Claude Fable5管制又解封,整个过程揭开了一个我们很少认真面对的事实。 我也算是看明白了,我们每天使用的AI能力,其实并不真正属于我们。 我们以为自己
阅读全文 →毋庸置疑,模糊需求等于模糊产出! 今天给公司核心团队详细分享AI使用心得,给所有人科普教学Agent如何使用,全球前沿的这些Agent怎么注册、怎么安装,阻碍很大,地域的问题这个大家都懂,姑且不展开。 其实,我发现大家还有一个非常核心的痛点,那就是想不出来怎么和自己的业务结合,以及如何挖掘具体的应用场景。 简单说,就是不知道怎么跟自己的业务想结合起来。 因此对这些新工具,就总是兴致缺缺,往往听别人说Agent很厉害,但总觉得跟自己关系不
阅读全文 →一个观察,游戏不是因为自由才好玩,恰恰是因为不自由才好玩。 以我热爱的中国象棋为例,玩的越久,越会发现象棋的魅力不在于每个棋子的能力,而在于对每个棋子的限制,在限制内极尽所能的运用规则。 車只能直走,但弃車往往能孕育飞刀和杀招,马走日但会被别腿,炮虽威力无边,但只能隔山才能吃子,尤其是只进不退的兵卒,蕴含着气吞山河的决绝和勇气。 还有,含蓄、谦虚、礼让的将帅,永远不能照面。 方寸棋局,千百年来却演绎出无数令人叹为观止的山河决战,智谋、引
阅读全文 →公元175年,洛阳太学门外,立起四十六块石碑。 蔡邕领命,把儒家七经一字一字刻了上去,作为天下读书人唯一的标准本。消息传开,每天上千辆车马堵在碑前,只为拓下一份正确的字。 这就是熹平石经,它要解决的问题只有一个,经书传抄百年,版本混乱,到底谁说的才算数? 朝廷的回答简单而霸道,刻在石头上的,才算数。 石碑之所以是石碑,不是因为它最方便,恰恰因为它最不方便。它笨重、昂贵、不可更改、必须由权力来立。 它用物理上的「永久」,换取解释上的「唯一
阅读全文 →不知道从什么时候开始,各个平台上上又冒出来一群人在“卖 Token”。 Token就是词元,就是大模型的计费单位。所有大模型背后都在烧 Token。官方API本来就是按这个收费的。 所以,既然它按量收费,就一定会有人出来倒手、分销、中转、赚差价。 逻辑很简单,好比AI世界的一套地下供电系统,官方电路又贵又进不来,便有人私下搭线、通电、分发。 卖Token这事,说白了就是一帮“AI黄牛”在做中转站生意。上游拿接口,下游卖额度,中间吃差价。
阅读全文 →最近有个观点,越来越明确了。 今年上半年,很多人都在研究Agent。 研究Codex,研究Claude Code,研究各种Skill,研究怎么让AI从回答问题变成直接执行任务。 这些当然重要。 但我越来越明确地认为,未来5~10年,真正拉开个人、企业和组织差距的,不是Agent,也不是某一个Skill,而是数据库。 更准确地说,是可被Agent调用的上下文资产,也可以理解成可调的、结构化的、优质的知识管理仓库。 为什么? 因为Agent
阅读全文 →我以前写过一篇文章,叫《为什么说会比喻是顶级的智慧》。这是我引以为傲的一个洞察和论断。 后来又反复写过赫尔墨斯主义、跨尺度同构、瓶颈迁移、生态位、遍历性。我一直相信,所谓洞察力,就是在两个看似毫无关系的事物之间,发现某种共同结构。 这个判断没有错。 但最近重新检查自己以前写过的文章,我发现了一个非常隐蔽的问题,会类比确实是一种智慧,但它也可能成为一种高级的自我欺骗。 因为结构相似,不等于机制相同。 比如,我们经常说企业像生物一样进化。
阅读全文 →今天想明白了一个问题。 我不是一个转型成科技博主的人,我是一个用科技和AI加持的广告人。 就这个身份的认同和心态的转变,彻底解决了一直以来的身份焦虑。有相当长的一段时间,我分不清我到底是谁,我在干嘛,以及我为什么要做这些事。 六个月前,我写过一篇「骑驴找驴」的文章,核心是说,这些年在职业发展上的挫败,我承认自己这几年没有实质性长进,承认项目偏执行,承认策划能力没有真正突围,承认热情被消磨,承认自己一度不想继续做广告。 其实,我也不是真的
阅读全文 →我们为什么总是误以为人生是线性的、因果是清晰的、成功是可复制的? 我们之前讲过英雄之旅,以及幸存者偏差是怎么产生的。 一、幸存者偏差、英雄之旅以及遍历性 比如一个创业者成功了,后来他说: 「我当年就是因为坚持、冒险、相信长期主义,所以才成功。」 听起来很合理。但问题是,很多同样坚持、冒险、相信长期主义的人,已经失败了,消失了,没有机会写自传、上访谈、做演讲。 所以幸存者偏差本质上是一种线性叙事幻觉,因为他成功了,所以他过去的每一步都被重
阅读全文 →接口,一个越来越重要的概念。 表面上是一个技术词汇,但它更像是一个理解世界的关键隐喻。 接口,不仅是 API,也不仅仅是程序之间怎么通信的问题。 接口,可以理解成,两个系统之间的连接、或者接触面,一种能融洽两种不同系统的通用机制。 比如,人和工具之间,人和组织之间,企业和平台之间,AI和人之间,AI和企业之间,都有接口。甚至更广义的说,人的语言、人表达方式、提问的能力、拆解问题的能力等等都是一种「接口」。 一、接口是可控的连接 更进一步
阅读全文 →“种瓜得瓜,种豆得豆。”这是一句耳熟能详的仿佛已经是一个常识谚语。 这句话本质上在谈论什么呢? 首先是因果一致性,这在逻辑上无懈可击。在现实中,你种下什么性质的因,最终大概率会收获什么性质的果,也是无可挑剔的。 但是,稍微深挖一下,就是发现没这么简单。 在“种”和“得”之间,隔着一个漫长的生长季,这个过程中,很多其他要素对“得”影响也是致命的。 回到社会层面,种到收之间却还隔着权力、运气和结构等鸿沟。 在现实社会里,种子不是平等分发的,
阅读全文 →我最喜欢的《三体III·死神永生》里,有一个情节曾经给我带来非常大的触动。 太阳系即将遭遇二维化打击,人类文明走到尽头。人们想在冥王星保存地球文明的信息,却发现光盘只能保存十万年,纸张最多二十万年。 最后,罗辑举起拐杖说。“把字刻在石头上!” 太震撼了,神一样的罗辑。 其实,人类文明发展了几千年,创造了计算机、互联网、人工智能,甚至拥有了神一般的力量。 但在时间长河面前,所有先进技术全部会失效。 我们最终只能重新使用祖先在远古时代使用过
阅读全文 →近日,OpenAI公布了一份新的长期计划,其中最引人注意的一句话是,让地球上的每个人都拥有个人AGI。 他们希望未来的人工智能,不只服务于研究机构、大型企业和政府组织,而是成为每个人都能调用的高能力助手,帮助普通人处理工作、学习、生活和创造。 OpenAI还给出了一个明确的内部判断,到2028年3月,公司相当一部分研究工作,可能会由AI系统与人类研究员共同完成。 这听起来像是一次能力平权。 过去只有大型机构才能拥有的研究、分析、编程和决
阅读全文 →自媒体首先是媒体,媒体的本质就是传播有价值的信息,降低干扰,减少噪音。 所以自媒体也一样。 截止目前,我业余时间断断续续做自媒体,也有两年的时间,但是没什么成效,我觉得这和内容有关系,也和形式与关系。 视频时代,非要写文章,也不是不行,写文章的目的是为了锤炼思维。 但是如果是为了传递信息,视频更直接更简单,更明确。 就是我今天突然想明白了一个问题,要不要录视频这个问题纠结了有段时间了,但今天就突然想明白了,为什么不录呢,大不了就是没人看
阅读全文 →最近刷各社媒的帖子,发现黑雷军的内容还是很多。比如在武汉吃早餐,被质疑是摆拍,还被小学生给吐槽了。 于是检索了一圈舆情,发现其实这些年,尤其是近几年骂声几乎没断。 一、为什么会挨骂 从他开始做汽车以来,仿佛挨骂就一直么有间断。 有一些内容确
阅读全文 →中国是世界上游记传统最深厚的文明之一,「山水」与「行旅」很早就成为独立的文学母题。 从《水经注》、《大唐西域记》、《徐霞客游记》到《湘行散记》、《撒哈拉的故事》、《文化苦旅》、郁达夫的《春风沉醉的晚上》等等…… 还有《奥德赛》、《鲁滨逊漂流
阅读全文 →之前看到过一个观点,觉得很有意思。 问:为什么全世界的后妈几乎都是坏人? 不管是古代还是当下,不管是国内还是国外,后妈似乎一直是一个“坏人”的形象。 其实这里有一个非常隐秘视角。 在关于“后妈”的这个母题里,能把故事讲出来、讲给孩子听、一代
阅读全文 →前段时间WorkBuddy更新,新增了「项目」功能。直至今天我才测试了一下,感觉非常好用。 一、项目演示 我们做个简单的演示。 开始新建,项目名称、具体指令、连接器、专家、技能都可以按照自己项目的属性,自行添加。 比如,我建一个市场分析相关
阅读全文 →200天前,我最大的困惑就是我需要找到一件事,这件事可以每天能干,要难度适中,且要百利而无一害。 首先想到的就是吃饭、睡觉,但这没意义。 后来,我觉得写作是有意义的。日更以来,最大的变化,就是我几乎再也没问过自己前面的那个问题了。 但我向来
阅读全文 →日更文章第199天: 之前,我们在一篇文章谈及学习方法论的时候,提到了——拆解。 其实,拆解,本质上是一种逆向工程的能力。 什么是逆向工程,是一种从结果反推原因的能力,拆解就是逆向工程在实践层面的表现形式。 我们来找个例子,这个例子是Cla
阅读全文 →日更文章第198天: 一个现象,AI越来越厉害之后,很多用AI产文字的人,遇到一个问题。那就是没有“人味”。 于是,出现了很多形形色色、奇奇怪怪的研究如何更有“人味”的方法论。 我觉得这就是一个悖论,你让一段不是人写的东西,有人味,本质上就
阅读全文 →今天我花费将近40分钟做了一套测试——盖洛普优势测评 全称 CliftonStrengths(早年叫 StrengthsFinder,中文常译「优势识别器」),是盖洛普公司基于心理学家唐纳德·克利夫顿几十年研究做出来的一套在线测评。 一个问
阅读全文 →WorkBuddy有三大应用场景,分别是,「代码开发」、「日常办公」和「设计创意」,今天,我将从这三个场景入手,全方位验证一轮,看看如何仅仅用2小时,从「模糊想法」到「落地上线」,通过WorkBuddy构建一个AI广告策展平台。 这两天有个
阅读全文 →人类不可替代 AI尚未触及的人类能力 150/ 007 AI 能模拟世界 但无法替代人的体验 「人类不可替代」系列第 7 篇 面向未来,哪些能力会越来越稀缺,越来越有价值,并且很难被 AI 真正替代? 这是「人类不可替代」系列第 7 篇。
阅读全文 →日更文章第194天: 有这样一个非常有趣的隐喻。 大概是说,汽车取代了马车,马并没有失业,真正失业的是马车夫,但是这并没有给社会造成太大的影响。 因为,曾经的马车夫,变成了司机。这部分人只不过是从”司“马变成了”司“机。 很多人用这种说法安
阅读全文 →日更文章第193天: 一个心理现象,如果你在一件事上耗费的成本越高,就越重视这件事,就越不容易搞砸这件事。 比如,你花费大价钱购买了一款软件,那你大概率会花很多时间来深度研究深度使用,如果没有将它的效用拉到极限,总会觉得亏的慌。 每月AI大
阅读全文 →日更文章第192天: 此前我数次撰文分享过腾讯workbuddy,大多是号召性的让大家亲自上手体验。 其实只要工具当真好用,何须要我来摇旗呐喊。 所以,我认为落到实处,细看workbuddy究竟如何使用?如何真实解决我们所遇到的问题?此类分
阅读全文 →