琳小航AI
热门词

琳小航AI 日报

2026 · 09 · 30

01今日头条GPT-6.1 Sol 发布

  1. 01新品

    GPT-6.1 Sol 发布:水平接近旗舰 Astra,价格只要五分之一

    内容:OpenAI 在开发者日发布 GPT-6.1 Sol,官方说它的智能水平接近旗舰模型 Astra,价格只要 Astra 的五分之一,定位是日常任务里的高性价比档位。

    亮点:博主 Theo 实测,它修掉了上一代表现忽高忽低的毛病,上限比 Opus 5.5 略低,但输出很稳。成本差距更明显:他跑下来 Sol 单个任务最多花 1.38 美元,Opus 5.5 最便宜的一轮也要 5.12 美元;单次请求读进去的 token 约 11 万,Sonnet 5 是 36 万。

02X 热议昨天互动最高

  1. 01开源

    Floorplan 3D单文件开源:装修模拟网页适配了iPad

    内容:作者用一个2000多行的单html文件做了个装修模拟小工具,浏览器打开就能画户型、摆家具,原本是自己用的,后来发现孩子当装修游戏玩得很起劲,又专门做了iPad触屏适配。

    用法:代码和在线体验地址都放在原帖里,想练手做类似小工具,或者给孩子找个动手项目玩的,都能直接照抄。

  2. 02开源

    伊利诺伊大学C与Linux系统编程教材GitHub全开源

    内容:伊利诺伊大学厄巴纳-香槟分校CS341系统编程课的教材在GitHub开源,2200多星两百多fork,从指针往后一路讲进程、内存、文件描述符和并发,代码和讲解全用C写,pdf、markdown、html三种格式都能导出。

    适合谁:想真正补齐系统编程这块知识断层的人可以直接拿来自学,不用再东拼西凑教程和大部头。

  3. 03Claude

    Anthropic公开Prompt调优方法论,官方Skill实测降本近八成

    内容:Anthropic把自己内部做Prompt优化、Agent评测和自动调优的方法论整篇公开,同时在Claude Code的官方技能库里上线了两个指令:build-eval用真实业务数据在项目里搭评测集,hillclimb在有了评测集之后自动改代码、跑分、去重防过拟合,直到把准确率提上去、把token账单降下来。

    数据:官方给出的客服Agent案例里,模型从Opus 5.5高档换成Sonnet 5低档后,测试集准确率从78.6%涨到90.5%,单次调用成本从4.6美分降到1美分,账单直接砍掉近八成。

    亮点:文章还给了四条评测铁律,比如别拿模型今天答错的题去建题库、裁判优先用程序而不是大模型判分,这些原则对自己手搭评测集也有参考价值。

登录后查看全部内容