实测下来,这次优化后很明显的额度节省,GPT Plus订阅现在可以用GPT-6 Astra了!!!
实测下来,这次优化后很明显的额度节省,GPT Plus订阅现在可以用GPT-6 Astra了!!!
这里使用的是Plus订阅的小号,在使用GPT-6 Astra hight的思考程度,能够保持用量和以前5.6 sol略高水平,请求次数和使用明显有所提高!!!
如果是在今天之前,5h额度早就清空了!!!
...
鉴于GPT6-Astra 如此的强大,有必要单独装一个浏览器给它用了。
鉴于GPT6-Astra 如此的强大,有必要单独装一个浏览器给它用了。
(否则会跟人抢浏览器用)
黄叔推荐了ego lite,马上交给codex安装,提示词:
“安装ego lite浏览器,配置和chrome一样的cookie和登录信息,然后Computer Use以后用这个浏览器”
几分钟安装好了,一键拷贝Chrome的登录信息,相当丝滑。
...
这个开源项目,它能把Claude变成一位拥有15年经验的设计师,这事儿确实挺有意思。
这个开源项目,它能把Claude变成一位拥有15年经验的设计师,这事儿确实挺有意思。
你不需要安装依赖或配置环境,直接把它放进项目就能用。它的能力覆盖了不少方面:
1️⃣ 生成DTCG格式的设计Token,统一管理颜色、字体和间距
2️⃣ 组件从零设计到可上线,附带状态和无障碍规范
3️⃣ 支持React、Vue、SwiftUI、Flutter ...
Minecraft 服务器,也开始进入 Rust 时代。
Minecraft 服务器,也开始进入 Rust 时代。
Pumpkin 是一个用 Rust 从零实现的 Minecraft 服务端项目,目标是打造更高性能、更易部署的服务器方案。
它采用多线程架构,支持 Java 版协议,并逐步完善世界存档、区块生成、实体系统、红石、玩家管理、指令和权限等核心功能。
除了基础服务端能力,Pumpkin 还提供插件系统 ...
最近看到一个挺有意思的 TTS 项目:sanoTTS。
最近看到一个挺有意思的 TTS 项目:sanoTTS。
它的思路很直接:把 TTS 做到足够小。
最小的 heart-nano 只有 294K 参数,模型权重 337KB,最大的也就 2.27M 参数。甚至可以直接跑在大约 $3 的 ESP32-S3 上,不需要云端,也不需要 NPU。
而且浏览器里也能直接跑,WebAssembly 全部在本地完成,不需要把文本上传服务器。
...
发现一个很有意思的开源项目:M3E Canvas
发现一个很有意思的开源项目:M3E Canvas
直在浏览器里拖拽 Material 3 Expressive UI,设计多个页面和交互流程,然后一键生成 Prompt,交给 Claude Code、Codex、Gemini CLI 或 Cursor 直接开始写 App。
从“画 UI”到“AI 写代码”,中间少了很多步骤。
它支持 Android / Web、多页面跳转、主题、动画、组件编排。
...
[开源推荐] 从零构建 AI 工程 (52.6K 🌟)
[开源推荐] 从零构建 AI 工程 (52.6K 🌟)
20 个阶段、523 节课、342 小时,从线性代数到自主智能体,为读者提供一条连贯的学习主干,作者
@ghumare64
https://github.com/rohitg00/ai-engineering-from-scratch
# 课程结构:20 个阶段、523 节课、约 342 小时
依赖关系是分层的,数学是基础,Agent 和生产是上层。
1 ...
如今大多数智能体并非代码,而是 Markdown 文件。
如今大多数智能体并非代码,而是 Markdown 文件。
对许多开发者而言,创建智能体不再意味着编写代码。
传统意义上的“智能体”指的是:
- LLM(逻辑逻辑模型)
- 智能体循环
- 工具连接
- 框架中的自定义逻辑
现在,对于许多团队来说,智能体由以下部分定义:
- Markdown 文件
- 角色描述
- 清晰的指令
- 约束和 ...
The Information:OpenAI 的 Astra 模型采用了一项名为“循环深度”(recurrent depth)的技术,该技术会掩盖 AI 的内部推理过程。
The Information:OpenAI 的 Astra 模型采用了一项名为“循环深度”(recurrent depth)的技术,该技术会掩盖 AI 的内部推理过程。
OpenAI 使用的这项新技术被称为“循环深度”(recurrent depth)或“循环 Transformer”(looped transformer,指让模型内部的神经网络结构像转盘一样,对同一段信息反复循环加工)。它能让 ...
推荐一个装机党必备的开源神器:reinstall。
推荐一个装机党必备的开源神器:reinstall。
电脑重装系统,传统方法还得下载镜像、制作 PE/U 盘启动盘、进 BIOS 调启动项,一套流程下来非常折腾。
这个项目直接把流程简化了:一条命令,就能自动重装系统。
Windows 11、Windows 10、Windows Server 都支持,还能安装 Debian、Ubuntu、Alpine、Rocky Linux、Fedora、Op ...
谷歌悄然发布了一款预测模式的AI模型
谷歌悄然发布了一款预测模式的AI模型
它名为TimesFM
→ 预测销售额、需求、市场价格、网络流量、加密货币波动性……
→ 基于1000亿真实数据点训练
→ 无需训练即可进行零样本测试
→ 100%本地运行,完全保护隐私
→ 免费开源
以前,你需要花费数周时间训练昂贵的模型
现在,你只需输入数据,它就能立即给出预测结果 ...
发现一个宝藏免费 API,40+ LLM 模型,全部免费用!
发现一个宝藏免费 API,40+ LLM 模型,全部免费用!
越南开发者做的 LLM API,感觉还挺有意思,分享一下。
目前可以看到 40+ 个模型,支持 OpenAI Compatible API,可以自定义 Base URL。
https://api.wusrouter.com
大部分模型可以免费使用,GPT 和 Gemini 目前有少量费用,其他模型暂时没有收费。
如果有需要测试不 ...
想给产品加 OCR?装完 Tesseract 再调一堆参数,中英混排还是糊成一团。
想给产品加 OCR?装完 Tesseract 再调一堆参数,中英混排还是糊成一团。
docTR 是个基于 PyTorch 的文字识别库,几行代码就能把 PDF 或图片里的文字整页抓出来。
它走两步:先把每个词在页面上的位置框出来,再把框里的字符读出来。定位和识别用的是两套模型,想换哪套都行。
GitHub:http://github.com/mindee/doctr
...
本教程讲解如何使用以下组件构建符合 PCI-DSS 标准的 GKE 安全框架:
本教程讲解如何使用以下组件构建符合 PCI-DSS 标准的 GKE 安全框架:
- 工作负载身份 (Workload Identity)
- 密钥管理器 (Secret Manager)
- 二进制授权 (Binary Authorization)
- 网络策略 (NetworkPolicy)
- VPC 服务控制 (VPC Service Controls)
- 私有服务连接 (Private Service Connect)
- Istio mTLS
- 以及 ...
🚨有人把 Claude Code 变成了一个 68 人的工程师团队
🚨有人把 Claude Code 变成了一个 68 人的工程师团队
你的 AI 代理知道如何编写代码。
但它缺少的是一个团队的支持。
它会根据每个提示即兴发挥……
忘记测试。
在刚刚引入 bug 的地方审查自己的代码……
Claude Code (ECC) 会投入整个团队的力量:
→ 68 个专业代理:一个负责规划,一个负责审查,一个负责修复构建 ...
微软这次放出的 VibeVoice-ASR-Streaming-7B,我觉得挺适合做实时语音 Agent。
微软这次放出的 VibeVoice-ASR-Streaming-7B,我觉得挺适合做实时语音 Agent。
它不是“录完一段音频,再慢慢转文字”,而是人还在说,文字就已经开始出来了。
比较实用的几个点:
支持实时流式转写、能识别谁说了什么、支持自定义 Hotwords,技术名词、人名这类词可以单独加强
支持中英日韩等 10 种语言
7B 版本,权重 ...
GPT-6 Astra 发布后的第一个周末,X 上最有意思的一幕出现了。
GPT-6 Astra 发布后的第一个周末,X 上最有意思的一幕出现了。
有人没有继续争论“这是不是 AGI”,而是把它拉进 Blender、KiCad、Unreal 和浏览器,开始做游戏、画电路板、建房子。
我筛了 7 个真正有工作价值的案例。
原来现在做 OSINT,已经可以把这么多公开数据塞进一张 3D 地球里了。
原来现在做 OSINT,已经可以把这么多公开数据塞进一张 3D 地球里了。
最近挖到一个开源项目 OSIRIS,打开浏览器就是一套实时情报大屏。
🌍 航班、卫星、海事、地震、野火实时汇总
📹 全球公开 CCTV 数据统一查看
🔥 NASA 火点、天气、冲突区域一张图掌握
🛰️ 还有新闻流、网络威胁、DNS / WHOIS 等 OSINT 工具
⚡ WebGL ...
有人把价值巨大的计算物理数据,直接开放给 AI 研究者了。
有人把价值巨大的计算物理数据,直接开放给 AI 研究者了。
The Well 是一个面向机器学习的物理仿真数据集,包含 16 类模拟数据,总规模约 15TB。
里面覆盖了流体力学、生物系统、声学、磁流体、超新星爆炸等复杂物理场景,把过去需要大量算力和研究资源才能获得的数据,整理成了统一格式,方便直接用于 AI 训练。
它的意 ...
一个开源的、部署在CF workers上的聊天室,支持实时文字、语音、图片。
一个开源的、部署在CF workers上的聊天室,支持实时文字、语音、图片。
特色:可以把聊天室内的任意一个群组,与一个 Telegram 群组绑定。绑定后,通过 Telegram Bot,两侧的消息会双向实时转发。
开源地址:https://github.com/aozorae/Edgechat
感觉这个项目的使用场景在国内...
...