一种实验性的 Linux 技巧:将 ELF 可执行文件的组成部分存入 SQLite 表,并通过专用解释器提取执行;结合 binfmt_misc 后,内核还能把符合特定标记的 SQLite 文件直接当作可执行文件处理。
llm-anthropic 0.27 主要完成对 anthropic Python SDK 1.0 的兼容。新版 SDK 将底层 HTTP 客户端从 httpx 切换至 httpx2,此前 OpenAI Python SDK 3.0 也进行了相同迁移。
GPT-5.6 现已在 Kiro 中提供,可协助开发者完成软件规划、构建、代码审查与测试,并进一步改善开发过程中的价格与性能表现。
llm-openrouter 0.7 已适配 LLM 0.32,可显示 OpenRouter 模型的推理轨迹,并改用 Responses API,同时新增 Shell、WebFetch、WebSearch 三种服务器端工具。
llm 0.32.1 通过将 openai 版本固定到 3 以下,临时修复了新安装时因 httpx 依赖缺失导致的启动问题;后续 0.33 计划改用 httpx2。
llm 0.33 主要更新了 OpenAI Python 3.x 兼容、嵌入接口的按次传 key 支持、模板可叠加,以及 reasoning_summary 选项。
文章概述 Joon Sung Park 先从艺术与计算的交叉切入研究,后来因《Generative Agents》与 Smallville 项目受到关注,并继续推进更大的目标:把人类行为建模成可用于推演现实的模拟系统。 从生成式代理到 Simile 《Generative Agents》展示了 AI 角色可以具备记忆、规划、社交与涌现行为,这成为他之后做 Simile 的起点。与只做任务型模型不同,Simile 更关注如何建立能反映真实人类决策的行为基础模型。 他们在建模什么 文中提到,Simile 采用长...
Bun 1.4 新增 Bun.WebView,可通过 macOS WebKit 或本地 Chromium 的 CDP 实现浏览器自动化。一项原型测试显示,加载复杂网页并执行 JavaScript 的服务可能需要 192MB 至 256MB 容器内存。
Promptwatch 的自动化监测显示,ChatGPT Search 中带有站点限定特征的搜索查询占比在 8 月初明显上升,同时 Reddit 被引用的概率似乎下降。这些数据仅覆盖其监测样本,尚不足以确认 ChatGPT 内部搜索策略的具体变化。
一位开发者分享了借助 ChatGPT 学会四元数的经历:AI 没有直接代写代码,而是通过互动教学帮助他完成应用中的旋转功能,也促使他进一步学习。
Poolside 与英伟达达成非独家技术许可协议,并获得后者 10 亿美元投资。109 名员工将加入英伟达,而创始人继续留在 Poolside。交易背后凸显前沿模型训练面临的算力、资本和数据中心约束。
编码智能体能显著提高代码产出,但代码量增长并不等于团队可以无限提速。新的瓶颈可能转向工程师理解和维护代码的认知能力,同时低成本加功能也更容易破坏软件的“概念完整性”。
一次针对 smolmachines/smolvm 的沙箱实验,目标是限制不可信代码的 CPU、内存、网络和文件访问。由于原测试环境缺少 KVM,研究改用支持 /dev/kvm 的 GitHub Actions 执行测试。
智谱AI CEO唐杰提出,模型能力不能再只用参数量衡量,数据、算力投入方式、部署条件与后训练同样关键。GLM-5.3的能力提升主要来自长周期环境中的强化学习训练。
Matt Pocock 推出的 /wayfinder 技能,面向目标尚不清晰的新项目与复杂规划场景。它通过拆分规划线程、原型验证和研究,再汇总为更完整的规格,降低长上下文与多会话规划的负担。
在发布日期固定、设计资源已投入其他项目的情况下,Stampli 借助 Codex 和 ChatGPT Work,将原本需要数周的发布制作流程压缩至数天。


