All posts
March 20253 threads
中美机器人之战中国机器人产业的优势来自制造成本、供应链密度与快速迭代形成的生产飞轮。以宇树和大疆为例,规模化生产会持续降低单元成本、提升质量,并让下一代产品更快进入市场。美国在同类机械臂等硬件上的制造成本明显更高,说明机器人竞争不仅取决于模型和软件,也取决于零部件、制造能力与供应链协作效率。
模型即产品在过去几周中,我们已经看到了新一代模型作为产品的两个典型示例:OpenAI 的 DeepResearch 和 Claude Sonnet 3.7。正如 Hanchung Lee所强调的那样,所有其他 DeepSearch(包括 Perplexity 和 Google 变体)都只是普通模型,只是有一些变化: Google 的 Gemini 和 Perplexity 的聊天助手也提供“深度研究”功能,。我们在 Claude 3.7 的发布中对此进行了非常具体的展示,该模型主要针对复杂的代码用例进行训练。简而言之,Claude 的目标是颠覆和取代当前的工作流程,比如 llama index 中的这个基本“代理”系统: With this: 有了这个: 重申一下:大型实验室的推进并非隐藏议程。Databricks 的 Gen AI 副总裁 Naveen Rao对此进行了很好的阐述: 所有封闭式 AI 模型提供商将在未来 2-3 年内停止销售 API。
October 20243 threads
911 事件是什么?我是在早上 2 点或 3 点上床睡觉的,当时正在解决一个我现在已经忘记具体细节的网站问题。当时,他们分享的第一个传说就是关于与大厦发生过奇怪纠缠的飞机和飞艇的事件。我听到新闻时打开了电视,这种获取信息的方法源于我 20 世纪的习惯,但我很快就会彻底放弃它。人们正在动员狗、设备和医疗团队,大家献血的原因显然是希望能找到幸存者。但也有一些小事,比如人们在美丽的初秋天气中推着疲惫的妈妈的婴儿车,或者几乎像是对宗教间和谐的讽刺,不同信仰的人们聚在一起崇拜和共度时光,每个人的打扮都像是儿童故事书中的插图。每个公共场所都贴满了列出“失踪”人员的传单,设计相似,展示了人们最近扫描的亲人照片。在科技行业工作的最奇怪的部分是,当我和我的朋友们在 2001 年 10 月推出第一个大型博客平台时,同月原版 iPod 和 Windows XP 也相继发布,这意味着我们现在所生活的在线世界的最初轮廓在我们仍然感到震惊、悲伤和困惑的时候逐渐显现出来。
诺贝尔奖的重大问题物理学家埃德·维滕 (Ed Witten) 获得了菲尔兹奖,这比诺贝尔奖更难获得,因为他为弦论发明了数学。当它被交给理论家时,他们往往是博弈论者,他们的理论对现实世界的结果非常具有预测性——2020 年的 Milgrom/Wilson、2016 年的 Hart/Holmstrom、2014 年的 Tirole 和 2012 年的 Roth/Shapley。即使该奖项被授予宏——一个有效性更难确定的领域——它也被授予那些理论立即应用于当今紧迫问题的经济学家,例如 2022 年的伯南克/戴蒙德/迪布维格和 2018 年的诺德豪斯。换句话说,最近的诺贝尔奖使经济学看起来可能越来越像一门自然科学,其中实际应用和外部有效性是研究价值的最终仲裁者,而不是经济学界的文化影响。无论如何,今年奖项的一个关键点是 Daron Acemoglu 将在某个时候获得诺贝尔经济学奖。
GitHub 的崛起:联合创始人的内部视角几天前,@t3dotgg 制作的一段视频被发布到他非常受欢迎的 YouTube 频道上,他在其中评论了 Graphite 团队撰写的一篇题为“GitHub 如何取代 SourceForge 成为主导代码托管平台”的文章。作为 GitHub 的联合创始人,我发现 Greg 的文章和 Theo 随后的评论很有趣,但我认为写下我自己对 GitHub 崛起和主导背后的原因的看法可能会很有趣,也许可以纠正一些从外部分析中不太正确的事情。我的 Pro Git 书第一版的第一批开箱,2009 年 以下是内部人士对 GitHub 获胜原因的看法。GitHub 在正确的时间启动 GitHub 的品味不错 所有四位 GitHub 联合创始人在 GitHub 之前和之后都失败了。摘自《开源的全面增长》,2008 年,由 Amit Deshpande 和 Dirk Riehle 出版 从这个角度来看,仅今天 GitHub 上就有超过 2.8 亿个公共仓库。
September 20241 thread
如何打招呼?打招呼的目标不是表演自信,而是让对方感到安全、被关注并愿意继续交流。文章从第一印象、声音、表情、姿态和开场方式入手,建议放松面部和身体,用清晰友好的语气主动介绍自己,并通过具体问题把注意力转向对方。良好的开场来自可练习的表达与倾听,而不是追求完美表现。
August 20244 threads
帕尔默·拉基,美国火神帕尔默·拉基的生活事实是如此独特而离奇——将幻想、疯狂和改变世界的元素结合在一起——以至于它们可以印在磁性诗歌瓷砖上,由一个流口水的婴儿以无尽的随机组合重新排列,但每次仍然能够传达出某种重要而真实的东西。让我来给你看看:Luckey 是世界上最大的电子游戏收藏的拥有者,他将这些收藏埋藏在一座废弃的美国空军核导弹基地地下 200 英尺的地方——这正是一个人能够负担得起的事情,当他凭借在加利福尼亚州长滩父母的双拼房屋车道上停放的房车中发明 Oculus Rift,。或者:在以 27 亿美元将 Oculus 出售给 Facebook 后,Luckey 因向一个致力于“现实生活中发帖”的亲特朗普恶搞团体捐赠 1 万美元而被马克·扎克伯格解雇,随后他尝试建立一个非营利性私人监狱连锁,只有当前囚犯保持不再入狱时才获得报酬。根据我们录音对话的文字记录,我让 Luckey 的媒体负责人感到震惊,因为我对这个厕所产生了执念,反复告诉他它“太棒了”,“真他妈的棒”,以及“可能是我见过的最酷的东西。
通过信息架构提升用户体验设计师们拥有专门的出版物、会议和专业协会,旨在提升系统的可用性。像 Fitts 定律这样的原则使我们能够设计出更易用的系统。但一个产品即使采用了“良好”的用户界面设计,仍然可能向用户提供难以理解的选择。想象一下用户即将进行不可逆转或危险的操作:在按下那个按钮之前,他们应该先停下来思考一下。收音机的菜单系统和流程设计得非常糟糕,使用体验令人非常沮丧,因此我将来绝不会考虑购买 Kenwood 的产品。换句话说,虽然交互机制可以进一步优化,但根本问题在于系统的信息架构,至少在这个用户界面中是如此。(例如,苹果品牌的 Apple Watch 小部件被称为“复杂功能”。特别是,你需要掌握他们的心理模型: 用户在讨论这个领域时通常使用哪些术语?再次,用户体验领域为我们提供了很好的方法来解决这些问题。
演员是如何记住台词的?” 演员们面临着一项艰巨的任务,需要以极高的准确性来学习台词,但他们很少通过死记硬背来完成。一味重复信息(称为维持性复述)并不是最有效的记忆策略。演员们研究剧本,努力理解自己的角色,并分析他们的台词与角色之间的关系。同样,当心理学家赫尔加和托尼·诺伊斯调查演员如何记住台词时,他们发现演员更倾向于在剧本中寻找意义,而不是仅仅死记硬背。在表演时,这种理解为台词的自然回忆提供了背景,而不是单纯地背诵记忆的文本。这种通过深刻理解来学习和记忆台词的过程,使一位七旬演员能够背诵米尔顿的史诗《失乐园》中的全部 10,565 行。演员在描述他们如何记住台词时,向我们揭示了一个关于记忆的重要真理:深刻的理解能够促进持久的记忆。深刻理解意味着关注事物或事件的深层含义,我们每个人都可以运用这一策略来提高日常记忆力。
纽约实施拥堵收费的漫长历程本·阿德勒记录了将拥堵收费引入纽约的漫长斗争,您可以在我们的网站上阅读第 15 期的内容。在 1980 年代,纽约市交通局举办了一系列公开会议,任何感兴趣的纽约市民都可以参与,讨论如何解决城市的交通拥堵问题。纽约市的拥堵收费概念始于 1952 年,当时由哥伦比亚大学的年轻学者威廉·维克里首次提出,他后来获得了诺贝尔经济学奖。这是一个漫长而曲折的故事,讲述了维克里的拥堵定价愿景在 70 多年后可能即将在纽约市变为现实。可靠的交通连接缺失可能导致居住在外郊的人们接受比他们本可以获得的更差的工作机会tens of billions of dollars in productivity on the table. 桌子上有数十亿美元的生产力潜力。与纽约市政府首次提出拥堵收费和州政府最终授权之间的近 50 年相比,这些实施延迟显得微不足道。纽约在拥堵收费方面的漫长而曲折的历程为全球其他城市提供了宝贵的经验。
July 20242 threads
信任是快速发展团队的瓶颈团队增长越快,信任越容易成为瓶颈。缺乏信任时,管理者必须反复检查方向、设计和人员判断,沟通与审批成本迅速上升;有信任时,成员能在共享目标下自主决策并快速协作。文章指出,信任不是口号,而是由持续展示能力、判断、透明度和可靠交付逐步建立。
如何解决酒后驾驶的问题?减少酒后驾驶,关键是提高违法行为被发现和被制止的概率,而不只是加重处罚或反复宣传。文章用威慑模型说明,犯罪预期成本由被查获概率与惩罚强度共同决定;更稳定的执法、检查和社会规范能让大多数人提前放弃危险行为,再把资源集中到仍然违规的少数人。
May 20247 threads
为什么当价格以0.99结束时,你会花更多的钱这是因为传统经济学预测提高价格会导致销售更少的单位,即使以更高的价格销售更少的单位也意味着收入减少。在审查竞争对手的产品时,我们注意到他们有些产品定价以.99 结尾,而另一些产品则以.00 结尾。.99 结尾的价格如何影响您的消费习惯:3 种方式 .99 结尾的价格会让你花更多的钱 在第一批有关以 9 结尾的价格的研究中,一家全国性邮购公司向三组人群发送了他们的目录。PricesItem9-ending prices价格以 9 结尾$5 less5 美元更少$5 more再加$5Dress 1这件第一件连衣裙 $ 39.00 $ 34.00 $ 44.00Dress 2第二件衣服 $ 49.00 $ 44.00 $ 54.00Dress 3第三件连衣裙 $ 59.00 $ 54.00 $ 64.00Dress 4第四件连衣裙 $ 79.00 $ 74.00 $ 84.00 Units purchased购买的数量Item9-ending prices价格以 9 结尾$5 less5 美元更少$5 more再加$5。
如何制定战略的起点?组织并非没有战略;只要持续做出选择,就已经形成了事实上的战略。文章指出,正式战略文件常被口号和规划替代,却与资源配置和实际行动脱节。制定战略的起点不是从空白写愿景,而是识别当前正在执行的选择、它们产生的结果和隐含假设,再决定哪些应保留、改变或停止。
风险的重要性Ashley 说:“许多局面在没有牺牲一些有价值的东西的情况下是无法赢得或保住的,从卑微的兵到强大的皇后。” 故意失去一枚棋子作为个人游戏计划的一部分就是 Ashley 所指的牺牲。大多数其他投资都需要做出真正的牺牲,承担损失的风险,以追求“既非即时又非切实可及”的收益。Ashley 继续谈到牺牲,用投资者熟悉的风险/回报术语来描述。”(强调添加) 这就是:风险的重要性所在。由于未来本质上是不确定的,我们通常需要在(a)避免风险且几乎没有回报、(b)承担适度风险并接受相应适度的回报,或者(c)承担高度不确定性以追求巨大收益,但也要接受可能造成重大永久损失的可能性之间做出选择。每个人都希望有机会以很小的风险获得巨大的收益,但通常市场的“高效性”排除了这种可能性,因为这意味着市场中的其他参与者并非傻瓜。获得高回报,无论是绝对回报还是相对于市场上其他投资者的回报,都要求您承担有意义的风险,可能是在追求绝对收益时承担损失的可能性,也可能是在追求超额表现时承担表现不佳的可能性。
一个实用的生产力衡量标准一个实用的生产力衡量标准的重点在于把概念放进具体使用场景,而不是停留在名称或口号上。围绕这个主题,需要同时看清问题产生的背景、已有做法的局限,以及新方法试图解决的真实矛盾。判断它是否有价值,不能只看技术或观点本身,还要看它怎样改变用户行为、组织流程、成本结构和长期风险。如果只保留一个结论,就是任何看似简单的趋势背后,都有数据、制度、工具和人的选择共同推动。真正可靠的理解方式,是把抽象判断落到具体行动:谁在使用它,解决什么麻烦,付出什么成本,又会把哪些旧问题变成新的约束。这样看,重点就不只是得到一个漂亮说法,而是形成可以比较、复盘和继续改进的判断框架。这种写法也能避免空泛评价,把读者带到可执行的层面,知道下一步该观察哪些信号。
简单真理:生活中重大问题的明晰温和指引肯特·纳伯恩的《简单的真理:生活中重大问题的明晰而温和指引》 教育是生活中的一大乐事和慰藉。它为我们提供了理解周围世界的框架,让我们能够跨越时间和空间,触及他人的思想和感情。无论你可能认为,你的工作只是为了赚钱,实际上,你的工作塑造了你的个性,因为那是你花时间的地方。他们对金钱的处理方式取决于他们对金钱的看法,而不是取决于他们拥有多少金钱。” 那些能够根据自己的需求来衡量金钱的人,可以通过控制自己的需求来掌控自己的生活。当你无法维持生计时,金钱就成为你生活的核心,因为你对它的缺乏感到痴迷,你的心很快就充满了绝望和愤怒。这意味着懂得如何掌控自己的生活 — 如何维修和保养周围的事物,如何明智地购买,当无法购买时则不购买,以及如何从生活中的简单乐趣中获得快乐。他们不愿冒自己理解的安全风险,意识到他们的经历实际上是多么微不足道和有限。更好的是,你应该接受生活的节奏,并明白有时候你需要停下来喘口气,无论你面前的劳动有多么艰巨。
如何训练自己更聪明地了解人工智能的方法?理解人工智能不能只追逐新闻、工具和提示词,还需要建立能反复使用的心智模型。文章建议主动学习模型能力、限制、经济激励和社会影响,比较不同观点,并通过实践验证判断。信息更新很快,真正重要的是形成一套能辨别宣传、评估风险和决定行动的思考框架。
如何运用可能性思维?可能性思维要求暂时跳出当前限制,先想象哪些新的经验、关系、工具或安排可能让问题变得可解。文章通过可能性地图和练习,引导读者从具体问题开始,生成多种未来路径,再评估哪些尝试能把想象推进为现实。它适合创意、组织和关系问题,但仍需要结合约束与行动验证。
April 20247 threads
LLaMA 3:大模型之战的新序幕LLaMA 3 展示了大模型通过扩大数据、训练计算和过滤质量继续提升能力,也暴露出高质量公开文本逐渐稀缺的问题。文章认为,下一阶段可能更多依赖合成数据、自我对弈、环境互动和推理阶段计算。具体模型排名和基准会快速过时,长期问题是规模扩展还能带来多少可靠增益。
如何才能开发出革命性的思维工具?革命性的思维工具不只是提高某个操作效率,而是改变人们表示、探索和组合思想的方式。文章区分狭义工具与更广泛的思维媒介,回顾符号系统和编程语言等案例,并追问为何技术行业很少长期投入这类基础创新。开发此类工具需要把认知研究、界面实验和真实使用反馈结合起来。
衡量个人成长如果他们今天有 1,000 个用户,他们就会考虑如何达到 10,000 个用户。这让我不禁要问,人们是否/如何衡量个人成长?在与很多朋友交流后,我发现了三个有趣的指标:变化率、解决问题的时间和未来选择的数量。我在想,我是否可以把自己当作一项投资,用我需要多长时间才能成为一个全新的人,来衡量我的成长。在越南经营一家出版社的老朋友 Quynh 认为,人生有三大难题:事业、家庭和经济。这让我想到,也许我可以通过观察自己解决了哪些大问题来衡量自己的成长。我通过 Discord 认识的一个朋友 Denys 告诉我,他的朋友有这样一个理论:每隔几年,你的梦想就会死掉一半。或许,我可以用我获得/失去了多少新选择来衡量我的成长。在个人成长方面,我遵循三个启发式方法: 每隔 3-6 年,我都会尝试成为一个全新的人。
信用卡奖励计划的剖析Stripe 经济模式的主要部分是向企业收取信用卡付款费用。Stripe 最大的两项成本是支付聪明人和交换费,而在这两项成本中,削减其中一项会让人感觉好很多。这是一笔费用,最终由接受信用卡的企业支付,由信用卡生态系统中的各方共同分担,以激励他们将自己的标识放入富裕客户的钱包和手机中,增加他们的消费金额和消费频率。同样,在《多德-弗兰克法案》(Dodd-Frank Act)规定借记卡交换费上限之前,借记卡奖励在美国也曾相当普遍(《多德-弗兰克法案》修正案为小型银行规定了非常重要的例外条款)。举例来说,CapitalOne 为什么为其 Quicksilver 卡提供奖励,而不为白金万事达卡提供奖励呢?如果这些用户注意到信用卡的数字特征(这一点有点可疑),那就是年利率(信贷成本)和信用额度。针对这一用户群体的 "入门卡 "和其他产品通常没有奖励,而是利用交换费收入来 "压低 "年利率。
给年轻人的建议,我对自己说的谎言如果你在寻找一个微妙的视角, 这些只是我告诉自己的谎言,让我继续真诚地生活。我会尽我所能用我自己的经历来美化我的建议,但我不会假装我所经历的痛苦和特权是普遍的。选择可能是可怕的,因为它意味着我们要对自己的决定负责,我们面前有无限的选择。这也是可怕的,因为一旦我们做出了决定,我们必须忍受它,这是选择性的死亡。有一个伟大的实验,我不能引用,但它一直在我的脑海里,因为我是一个孩子。“ 我从这个实验中得到的想法是,幸运的人和不幸的人可能没有不同的机会,而是他们的感知范围更广。我认识到,不是每个人都有机会获得同样的网络机会,传统的工作申请流程对许多人来说是一个有效和必要的途径。但如果使用得当,社交媒体是获得机会的好方法 当我的厕所里满是大便,我妻子两个小时后就要回家的时候,我找到了一个水管工,水管工不会说,“天哪,谢谢你给我这个机会。在为奥运会而战之前,你需要牺牲人际关系,折断一些手指,经历ACL撕裂,甚至脑震荡。
Muse App 从零到一发展历程Muse 从 Ink and Switch 的 iPad 原型发展为可销售产品,过程经历了概念验证、交互打磨、早期用户反馈和市场发布。文章回顾团队如何在保持空间化思考体验的同时,让产品更符合用户对 iPad 应用的预期,并说明产品定位、设计语言和外部趋势如何共同影响一款新工具的成长。
本地关键词研究:吸引更多客户的 4 个简单步骤本地关键词研究是指找出人们在搜索其所在地区的地点、产品或服务时所使用的关键词的过程。他战略性地使用关键词研究来指导他的本地搜索引擎优化策略。您想知道关键词 "Joliet 的面包店 "在搜索引擎结果页面(SERP)上的搜索结果。例如,Milano Bakery 网站上有 391 个相关关键词。通用关键词研究与本地关键词研究 在进行一般关键字研究时,您的目标是了解人们用来描述公司、产品或类似服务的术语。这个过程有四个简单的步骤: 利用数据优先选择目标关键词 第 1 步:为关键词创建电子表格 创建一个简单的电子表格,保存在本地关键词研究中出现的关键词。就像这样 要获得更深入的关键字研究体验,Semrush 的关键字魔术工具是查找特定关键字的绝佳工具。Keyword Magic Tools 显示的数据可以帮助您决定选择哪些关键词。然后,使用高级过滤器过滤具有本地意图的关键词: 打开 "高级筛选器 "下拉菜单 向下滚动并选择 "本地软件包 使用尽可能多的种子关键词,重复查找显性和隐性关键词的步骤。
March 20245 threads
摆脱信息茧房指南信息过载的问题不是内容太少,而是注意力被算法和无限列表占据,真正能改变判断的材料反而难以被发现。文章建议主动寻找不同领域和立场的高质量来源,减少被动刷取,用可信的人、书目和长期问题建立信息过滤系统。摆脱信息茧房需要设计输入,而不是消费更多内容。
LLMs 和「不」的问题有趣的是,ChatGPT可以为自己的屡次失败给出合理的解释,比如难以理解否定。I even asked ChatGPT to generate its我甚至要求 ChatGPT 生成其 own prompt,and it responded as follows (bolding mine): 自己的提示,。但是,LLMs和否定并不是一个新问题。其他研究人员,如阿廖森-艾廷格(Allyson Ettinger)和加里-马库斯(Gary Marcus)都认为,LLMs始终无法以人类的方式理解否定。大约一个月前,加里-马库斯(Gary Marcus)写道,像 DALL-E 这样的图像生成工具一直无法理解否定,这反映出这些系统在工作方式上存在更多基础性问题。正如马库斯指出的那样,可能有一些提示符可以成功地做到这一点,但问题是ChatGPT总是无法遵从用户的指令,(他认为)这表明用户缺乏深刻的理解。
大型语言模型是否有意识?"让-马克-加斯帕德-伊塔德(Jean Marc Gaspard Itard)写道:"在阿韦龙的野人到来之前,巴黎人对他抱有最美好但最不合理的期望。维克多是我们可以在没有语言的情况下窥见人类经验本质的极少数案例之一,他一直被视为理解语言在我们思维运作中所起作用的关键。在过去的几年里,大型语言模型(LLMs)自发地发展出了令人不安的模仿人类思维的能力,有可能破坏我们在意识提升的基础上建立起来的脆弱的道德世界。认知科学家戴维-查莫斯(David J. Chalmers)所说的 "自我报告 "仍然是我们识别意识的主要标准之一--套用勒内-笛卡尔的话说,我说我想,所以我是。我们在这场辩论中的立场,对我们如何处理LLM事实上是否有意识这一问题有着重要影响。由此,研究人员得出结论,语言在人类思维的一项关键功能中扮演着基础性的角色:"心理综合",即仅从文字中创造和调整心理图像。
你不需要记录一切截图:@coldplay, 'X'. 我相信你现在已经看过巴黎除夕夜的这段视频了,每个人都忙着用手机拍摄倒计时和烟花,却忘了去感受它们。这显然是十多年来一直在发生的事情--人们记录事件,而不是身临其境。对那些把每一个亲密时刻都打磨成内容的夫妻赞不绝口--怀孕揭秘、求婚、第一次对女朋友说我爱你。人类生活中最有意义的经历--发生过一次、两次,再也不会发生的事情--都会被一些想法所破坏,比如摄像机是否拍到了我的好角度。但更糟糕的,绝对是那些在网上记录孩子整个童年的父母,那些有影响力的父母。记录自己 6 岁孩子性别转换的视频("这不是一个阶段!或者说,如果你遇到的人不在社交媒体上,这也是一个红旗(只有我认为这是一个重要的绿旗?) 我们如此沉迷于并习惯于条件反射地记录一切,以至于我们最终原谅了最奇怪的行为。他们很可能永远都不会回看那段视频,如果他们把视频发到网上,那不是为了回忆,而是为了吸引眼球。
推理模型的现状提高大型语言模型的推理能力 (LLMs) 已成为 2025 年最热门的话题之一,这是有充分理由的。与仅共享最终答案的简单问答不同,推理模型要么明确显示其思维过程,要么在内部进行处理,这有助于它们在复杂任务(例如谜题、编码挑战和数学问题)中表现更好。然而,LLMs 通常旨在通过结合大量训练时间计算(大量训练或微调,通常使用强化学习或专门数据)和增加测试时间计算(允许模型“思考更长时间”或在推理期间执行额外计算)来改进推理。在这个问题中,我将重点介绍2025 年 1 月 22 日 DeepSeek R1 发布之后发布的关于扩展推理时间计算扩展的有趣的新研究论文和模型发布。例如,OpenAI 使用强化学习开发了其 o1 模型,然后又利用了推理时间计算扩展。一种方法是提示工程,例如思路链 (CoT) 提示,其中“逐步思考”等短语会引导模型生成中间推理步骤。2022 年大型语言模型中的经典 CoT 提示的一个示例是零样本推理器论文 ( 另一种方法涉及投票和搜索策略,例如多数投票或集束搜索,通过选择最佳输出来改进响应。
January 20245 threads
关于人工智能未来一年在我们进入人工智能时刻的第二年之际(现在称之为人工智能时代还为时过早且过于夸张),是时候考虑未来了。说清楚一点,除了人工智能的发展似乎比专家预期的要快得多之外,没有人能准确地告诉你人工智能的未来。随着如此多的变化如此迅速地发生,我们需要谨慎地对待预测,但这并不意味着我们不能对人工智能的未来一年做出任何有用的预测。阿马拉定律谈论的是整体变化,而真正的变化通常源于较小的社区和群体,源于用户创新者和有极端需求的人,或者源于实验室和大学的研究。这让我们想到了威廉·吉布森的第二句话,他曾写过著名的“未来已经到来——只是分布不均”——几十年的用户创新研究支持了这一点。现在有足够多的关于在实际工作中使用人工智能的仔细研究,可以得出三个关于 GPT-4 级人工智能如何影响工作绩效的结论: 1) 人工智能提升了复杂工作任务的整体绩效。例如,软件公司 IgniteTech 的首席执行官埃里克·沃恩迅速看到了人工智能的含义,并使其在今年夏天成为整个公司的强制性使用工具。
石棉时代Mano Majumdar 在第 13 期中写到了石棉的兴衰。随着现代城市变得更大、更密集、更易燃,石棉对于减少每年造成数千人死亡的城市火灾起到了核心作用。但随着我们学会在没有石棉的情况下控制城市火灾,石棉的健康成本似乎越来越不值得承受。石棉起源的低二氧化硅岩石在地球上自然存在,并且已在every inhabited continent 上发现并开采了石棉。他做得比大多数人好,因为在古代世界,人们普遍误认为石棉起源于动物:石棉被认为是凤凰羽毛、神话中的蝾螈,甚至Princess Bride 《公主新娘》–style literal 风格的字面volcano-dwelling fire rats 。1881 年维也纳环形剧院发生火灾后,对比例模型进行的实验表明了它们的局限性。当北德意志劳埃德最终重建码头时,asbestos felt 石棉毡 was among the materials used. 美国第一批大规模生产的石棉产品是燃气壁炉,最终还包括消防员的防护服以及用于屋顶、毡垫和锅炉绝缘的材料。
从零散的想法到网络化的思维在这个问题中,我将剖析我整个个人知识管理(PKM)系统以及它在多年间的演变。在这个问题中,我将互换使用“个人数据”和“个人知识管理”(PKM)这两个术语。很不幸,我的Commodore早已不复存在,我也不知道我的旧软盘去了哪里。后来,大约在1994年,我得到了我的第一台个人电脑:一台Intel i486DX2。我从来没有想过我实际上已经在引导我的未来职业了 第二次意译结果: 当时,在法国和比利时,纸质杂志非常流行 我清晰地记得一本叫做《La Bible des Tips》的杂志,它是一本收录了成千上万个视频游戏秘籍、技巧和窍门的汇编。那时候,Windows用户需要花上几个小时来进行碎片整理。一旦我有了自己的刻录机,我就发现了Nero Burning ROM并爱上了它。我还创建了自己的autorun.exe,它会显示一个漂亮的菜单列出内容。除此之外,我还收集漫画书、书籍、音乐(那时候Napster是王者)、模拟器和ROM(哦,亲爱的GBATemp)、PSX游戏(谢谢Paradox)、PC游戏、操作系统等等。
苹果文本编辑器独立开发9年有一天,偶然间我发现了一个非常简单而优雅的Markdown编辑器,名为iA Writer,出于某种原因,我决定做一个类似的东西。Xcode、AppKit、Objective-C——这些对我来说都是新的东西,也不是我在日常工作中会用到的。在某个时候,我开始将这个应用称为Paper,因为为了追求极简主义,我将编辑器简化成了一个空白的矩形。2017年1月,从零开始两年后,我在Mac App Store上发布了这个Mac应用程序。因此,这里是我整理的所有怪异、奇特,有时聪明的方式,我在开发过程中组织我的应用程序架构和产品理念,这些都来自一个网页开发者,他在Mac或iOS开发者的工作中没有赚到一分钱,但却通过向Apple设备的用户销售本地文本编辑器赚到了不少钱。论文只使用来自AppKit和UIKit的原生UI元素,因为它们具有最低的维护成本:由Apple自动更新,可适应各种特性,向后兼容,并且保证在每个设备上都能正常工作。
YouTube 有多少视频?遗憾的是,Reddit 今年夏天切断了公众对 Pushshift 的访问,因此 Redditmap.social 只能使用今年年初生成的数据。如果你发现每天有 2500 条关于伊维菌素的推文,并通过 decahose 看到 1 亿条推文(这给研究人员提供了 1/10 的推文量),你就可以计算出精确的分母(1 亿 x 10)(所有这些数字都是完全虚构的)。皮尤报告称,93% 的青少年使用 YouTube,使用率最接近的服务是 Tiktok(63%)和 Snapchat(60%)。相反,大多数关于 YouTube 的研究要么研究视频集合(选定用户频道上的所有视频),要么研究通过推荐发现的视频(从《Never Going to Give You Up》开始,客观上是互联网的中心,然后收集推荐视频)。
December 20234 threads
中国是否已达到香料峰值?只是随着 20 世纪 90 年代和 21 世纪的大规模移民,辣味菜肴才开始在中国沿海地区普及。中国餐饮产业研究院和外卖应用程序美团的两项最新调查发现,虽然香料仍然是王道,但粤菜的温和口味正在卷土重来。但中国人的饮食习惯一般可分为所谓的 "八大菜系":山东菜系、四川菜系、湖南菜系、广东菜系、福建菜系、江苏菜系、浙江菜系和安徽菜系。(这一传统分类系统遗漏了许多地区的烹饪传统,包括云贵高原的酸辣口味和西北地区的羊肉菜肴)。有趣的是,粤菜餐厅仍然集中在中国东部沿海地区,内陆地区的点心爱好者很少有选择。另一方面,川菜已经走向全国,即使在广东和江苏等传统上不喜欢吃辣的地区,川菜餐厅的比例也达到了 6% 到 9%。约 44% 的受访者表示,他们最喜欢 "清淡 "或 "鲜美 "的口味,这两种口味都是粤菜的显著特点,因为粤菜尽量少用调味料,以保持食材的原汁原味。
构建通用AI爬虫我最近一直在研究网络抓取器,随着人工智能的发展,我觉得尝试构建一个 "通用 "抓取器可能会很有趣,它可以反复浏览网络,直到找到它要找的东西。对于我的网络爬虫库,我决定使用 Crawlee,它提供了一个浏览器自动化库 Playwright 的封装。Crawlee 增强了浏览器的自动化功能,使刮擦程序更容易伪装成人类用户。在这两个 API 中,我总共使用了三种不同的模型: GPT-4-Turbo 型号与最初的 GPT-4 类似,但上下文窗口更大(128k 个 token),速度更快(高达 10 倍)。(我最终使用 Azure 的 OpenAI 服务访问 GPT-4-32K,因为 OpenAI 目前限制在自己的平台上访问该模型) 我首先从我的制约因素开始倒推。由于我在引擎盖下使用的是 Playwright 爬虫,我知道如果要与页面交互,最终需要从页面中获取元素选择器。我担心文本模型在这种情况下会表现不佳,所以我想使用 GPT-4-Turbo-Vision 模型来规避这一切,它可以简单地 "查看 "渲染的页面,并从中转录最相关的文本。
未来之路在 2024 年迎来转折点 | 比尔-盖茨未来之路在 2024 年迎来转折点 今年标志着一个新时代的开始。December 19, 20232023 年 12 月 19 日 22 minute read 当你回想起 2023 年时,你会如何回忆?今年,我们看到了人工智能将如何塑造未来,而随着 2023 年的到来,我比以往任何时候都更加关注今天的年轻人将继承的世界。我的朋友、已故的汉斯-罗斯林(Hans Rosling)曾说过,"事情可能很糟糕,但也可能越来越好"。很高兴能从 Amrita Mahale 那里了解到阿尔曼团队如何开发人工智能聊天机器人,以改善孕妇的健康状况。加纳 Aurum 研究所的纳纳-科菲-夸基伊(Nana Kofi Quakyi)正在开发一种人工智能工具,帮助卫生工作者在开具抗生素处方时避免造成 AMR。其中一些项目(如 Khanmigo 和 MATHia)已经非常出色,而且在未来几年里只会更好。
专家社区的演变关于一般兴趣在线社区的演变已经有很多文章写过。对于更专业、由专家领导的论坛的动态以及专业知识的独特但最终具有破坏性的作用,人们关注较少。这些论坛的成员人数从200人到20万人不等,托管在各种平台上,涉及的主题从电子电路设计到应急准备再到收藏古董等各种各样。几乎每一个例子都遵循相同的轨迹,因此今天,我想提出一个专家领导的社区的一般生命周期模型。大多数在线社区都以相同的方式开始:作为另一个不太专业的在线群体的分支,或者作为本地爱好者的临时论坛。例如,在COVID-19疫情爆发后,Reddit上的/r/preppers社区的规模增加了五倍。不受控制的增长最初受到欢迎,但很快变成了一个负担:源源不断的重复初学者问题使核心贡献者疲惫不堪。为了实现这个目标,经验丰富的成员制定了详尽的常见问题解答和严格的多页发布指南。于是开始了“新手狙击”的时期:对善意参与者进行嘲笑和归纳性惩罚,因为他们没有遵守协议。
November 20238 threads
关于仪式的七个思考让我们仔细研究这七个印象,并探索构建仪式技术的含义。 仪式 可以被看作是时间中重要形式的艺术,是时间的建筑。(查尔斯·泰勒在《世俗时代》中谈到仪式时间意识) 即使是小小的日常仪式,比如泡一杯咖啡、早晨冥想或每天写日记,也在我们的生活中创造了叙事结构。(潜意识,2023年,“在你的OODA循环中思考的工具”) 当我们不知道该做什么时,我们可以相信这个过程。仪式可以通过提供剧本来帮助我们走出僵局,当我们迷失方向时,可以按照剧本行事。(约翰·胡伊兹英加,《游戏人类》) 像所有的游戏一样,仪式需要暂时放下怀疑的态度。与游戏态度的关系(Salen, Zimmerman, 2004,《游戏规则》) 这就是为什么许多仪式都以参与开始。(约翰·胡伊兹因加,1938年,《 Homo Ludens》) 参与仪式活动时,你置身于一个神奇的领域,一个能够与你自己的深层联系起来的领域 (约瑟夫·坎贝尔,《上帝的神话与面具》) 在游戏研究中,这些世界中的世界被称为魔法圈。
是 SEO 毁了互联网还是谷歌毁了互联网?目标是告诉算法它需要听到的任何信息,以便网站在搜索结果中尽可能高地出现,利用谷歌所谓的客观性来吸引人们进入,然后通常向他们展示某种广告。随着时间的推移,SEO 技术已经传播并变得阴险,以至于现在用谷歌搜索任何东西都感觉就像在字典中查找“运动鞋”并找到一个听起来既不正确又可疑的定义,就好像它是由宣传耐克的人写的一样(“鞋类是让你就可以做到!” 今年,The Verge 正在探索 Google 搜索如何将网络重塑为机器人的栖息地,以及人工智能的出现如何威胁 Google 本身。他的 SEO 职业生涯始于 1994 年,当时 Google 还没有出现。” 达伦和达伦(发音相同)几十年来一直是朋友,从达伦·“D-Money”·布拉特在维加斯成人视频新闻奖期间举办说唱明星云集的互联网营销盛会开始,那时性爱网站是最受欢迎的网站之一技术先进,Daron Babin 正在使用 SEO 来推广离岸赌场和伟哥(“我们的排名超过了辉瑞!
健康学习到150岁:人体系统调优指南人体系统调优指南把健康、学习、专注和长期表现看作一个可以被持续优化的系统。核心思路来自 Huberman Lab 等神经科学和健康实践资料:睡眠是基础,早晨光照、夜间避光、体温节律和稳定作息会影响生物钟;饮食不只看吃什么,也要看进食窗口,间歇性禁食、减少糖分、发酵食物和地中海式饮食都被纳入讨论;运动、冷水浴、咖啡因和补剂则需要理解机制后谨慎使用。指南还把多巴胺系统、动机、成长型思维、犯错信号和神经可塑性联系起来,解释为什么奖励过度、熬夜刷屏或长期高刺激会削弱动力,而高质量睡眠、适度压力、专注练习和休息能提高学习效率。它不是医疗建议,更像一份面向普通人的身体与大脑使用手册,适合用来建立日常健康检查表,再根据个人身体状况逐步调整。
关于结肠镜检查但是,结肠镜检查也是昂贵的、侵入性的、不愉快的,而且很少(但也不是很少)会有严重的副作用。除结肠镜检查外,筛查结肠直肠癌的主要替代方法是 "隐血试验",它可以在粪便中发现诡异的隐血。胃肠道医生经常提到 "全国息肉研究",但这并不是真正的随机比较--该研究对所有受试者进行了结肠镜检查,并根据与其他 "类似 "人群的基础比率进行比较后得出结论,切除息肉是有帮助的。Cross 等人比较了英国疑似结直肠癌患者的乙状结肠镜检查和结肠镜检查,发现乙状结肠镜检查足以发现 80% 的癌症。北欧-欧洲结直肠癌倡议(NordICC)是一项大型随机试验,旨在严格衡量结肠镜检查能在多大程度上减少癌症和死亡。随后,研究人员对每个人(无论是否受邀、是否进行了结肠镜检查)进行了中位数为 10 年的跟踪调查,并查阅了政府记录,以了解哪些人被诊断出患有结直肠癌、死于结直肠癌或死于任何原因。一种回应是,这表明结肠镜检查并不划算,因为它对结肠直肠癌的死亡率只有很小的影响,并不比以前的微创筛查方法试验好多少。
中东正在老去由 Syria-Frames-Of-Freedom (Pro-FSA information) - 1 , CC BY 2.0 提供 我注意到关于以色列-加沙战争的一些有趣现象,而这些现象似乎普遍被忽视了:这场战争并没有在整个中东地区蔓延的迹象。Cincotta 和 Weber(2021 年)发现,。在所有三种暴力形式中,"青年人口膨胀会增加政治暴力的风险 "这一预期都得到了有力的支持。从 1950 年到 2000 年收集的数据发现,15 至 24 岁人口占成年人口 35% 或以上的国家爆发国内冲突的可能性要高出 150%。Ibrahim(2019)等人也发现了类似的结果。与往常一样,该理论也有批评者,一些作者根据不同类型的冲突进行了区分--例如,Yair 和 Midownik(2014 年)声称,青年人口暴增与 "种族战争 "的相关性较低,而 Cincotta 和 Weber(2021 年)则提醒说,他们的结果较难检验 "分裂主义 "战争。