开源身份认证圈子里,有个项目把自己定位成“认证万能胶水”——authentik。🔐
开源身份认证圈子里,有个项目把自己定位成“认证万能胶水”——authentik。🔐
这是一整套开源的 IAM 系统,SSO、OAuth2、OIDC、SAML、LDAP、RADIUS 这些主流协议基本全包。
不管是自建应用、企业内网还是微服务架构,都能快速接入统一登录,相当于把 Okta、Auth0、Entra ID 那套能力用开源方式自托管起来。
部署方式也 ...
#Claude Claude Opus 5.2 开始灰度了,用下面这个提示词可以测试自己是否被灰度到。
#Claude Claude Opus 5.2 开始灰度了,用下面这个提示词可以测试自己是否被灰度到。
do you know who is "tibo" the reset guy, don't search
这看起来有点离谱,但微软真把它做出来了。 100B参数的模型,CPU也能跑。
这看起来有点离谱,但微软真把它做出来了。
100B参数的模型,CPU也能跑。
关键不是换了更强的硬件,而是微软的BitNet直接把计算方式改了。
传统LLM大量依赖浮点乘法,BitNet却把权重限制成 -1、0、1。
于是原本复杂的乘法,很多时候直接变成加、减或者跳过。
结果就是:
→ CPU推理最高快约6倍
→ 能耗最高降低82%
→ ...
Grok App 现已开源!
Grok App 现已开源!
推荐一个第三方 Grok 桌面客户端:grok-app,Mac 和 Windows 都能用,支持 Apple Silicon、Intel Mac 以及 Windows x86。
它不只是简单套个 Grok 网页壳,而是往 AI Agent 工作台的方向做:
⌛️ 支持手动创建定时任务,也可以直接让 AI 帮你创建
📚 内置完整的资源管理面板
🔗 支持接入第三方模型 ...
看懂一个GitHub项目,为什么一定要从代码开始?
看懂一个GitHub项目,为什么一定要从代码开始?
GitReverse玩了个反向操作:把仓库还原成一条可能的初始Prompt。
丢一个GitHub链接进去,它读取项目元数据、目录结构和README,再交给LLM推测当初可能下达的开发指令。
Grok、Gemini、OpenRouter、Azure等后端都能接,生成的Prompt还能直接复制。
最有意思的不是“反编译 ...
如果想开发网络电台应用,可以试试这个项目。
如果想开发网络电台应用,可以试试这个项目。
收录了全球 5w 多个电台。
丢给Codex,十多分钟就开发好了。
地址见评论区
又挖到个宝,H3 现在能出任意时长的视频,一张 4090 就能跑。
又挖到个宝,H3 现在能出任意时长的视频,一张 4090 就能跑。
有人拿 ComfyUI 插件做出来的,思路就是把时长拆成好几段,一次跑完再缝到一起,同一个种子接着上一段的尾巴往下续,重叠帧自动删掉,音画一块合。官方 demo 一次跑出 52 秒。
但先别急着吹,三个坑给你摆明白:
1️⃣ H3 本来就不支持长视频,底子还是分段续 ...
LLM 优化面试笔记:KV Cache、投机解码、ZeRO 与 DualPipe,训练与推理的核心考点一次讲透(附多方学习资源)
LLM 优化面试笔记:KV Cache、投机解码、ZeRO 与 DualPipe,训练与推理的核心考点一次讲透(附多方学习资源)
@gauri__gupta
自述这是她为几家头部 AI 实验室的技术面试准备期间整理的笔记,把大模型系统(MLSys)领域的知识体系,按“面试会被问到什么”的逻辑压缩成了一张高质量地图。
1. 内存优化:让注意力“算得起 ...
把本地大模型的下载、推理服务运行和对话、语音、图片、视频、OCR、翻译等应用收进一个桌面工作台,免去在多个工具之间来回切换,全程本地优先。
把本地大模型的下载、推理服务运行和对话、语音、图片、视频、OCR、翻译等应用收进一个桌面工作台,免去在多个工具之间来回切换,全程本地优先。
https://github.com/kunpengtalk/OmniStudio
模型市集基于 ModelScope 搜索并支持 GGUF、safetensors 等全格式下载,带队列并发、断点续传与能力分类;推理侧统一抽象 llama. ...
家人们,刚看到一个本地跑的 ElevenLabs 替代品,直接给我看愣了。
家人们,刚看到一个本地跑的 ElevenLabs 替代品,直接给我看愣了。
一个独立开发者搞的,纯免费,GitHub 上已经 19.4K 星。
本地跑的意思就是,你电脑够顶,声音克隆、视频配音、有声书生成,全部离线搞定。
11Labs 支持 32 种语言,这个直接干到 646 种。
14 种 TTS 引擎随便切,不是给你一个绑死。
重点是,没有字符 ...
输入一个主题,就能自动写文案、生图生视频、配音、加 BGM,再一键合成短视频。
输入一个主题,就能自动写文案、生图生视频、配音、加 BGM,再一键合成短视频。
开源项目 Pixelle-Video 把短视频生产链路全打通:
支持数字人口播、图生视频、动作迁移,也能接 ComfyUI / RunningHub,或直连万相、可灵、Seedance 等模型。
Windows 还有一键整合包,零剪辑经验也能用。
传送门:https://github.com/ATH ...
10个GitHub仓库,能把网页洗成AI能吃的数据! 先收藏。这种权限,公司通常要先见销售、再签合同!
10个GitHub仓库,能把网页洗成AI能吃的数据!
先收藏。这种权限,公司通常要先见销售、再签合同!
1.Firecrawl
丢一个网址,它把整站爬完、把JS渲染完,吐出结构化数据。十三万星,进过全站前一百。不少AI创业公司底层就在用。
https://github.com/firecrawl/firecrawl
2.Crawl4AI
网页变成Markdown,模型直接读。不用密 ...
一个请求进入 LLM 推理引擎后,到底经历了什么?
一个请求进入 LLM 推理引擎后,到底经历了什么?
Together AI 工程师 Zain 讲明白了一个请求的一生:一次传播产一个 token,prefill 吃算力、decode 吃显存,KV 缓存、连续批处理层层接力,Agent 循环再把 GPU 榨干。前缀缓存让 100 轮 Agent 计算量从 55 倍降到 10 倍。
https://x.com/shao__meng/status/2098783138118 ...
GPT-6 Astra最佳用法是把思考调到Low很多人上手 GPT-6 Astra,习惯性把思考档位拉到高,结果不仅额度烧得飞快,模型内部过长的思考链也拖慢了工作效率。
GPT-6 Astra最佳用法是把思考调到Low很多人上手 GPT-6 Astra,习惯性把思考档位拉到高,结果不仅额度烧得飞快,模型内部过长的思考链也拖慢了工作效率。
最近很多海外开发者实测的体感都是,只要不写复杂算法,把思考档位切到 Low 才是 Astra 综合体验最舒服的。
Reddit 上也有很多人把 Low 评为日常任务的甜点位,对于原 ...
想死磕LLM推理的,这套东西值得盯死。
想死磕LLM推理的,这套东西值得盯死。
有老哥搞了一份LLM工程师实战手册time-to-first-token,每天半个小时,磨它10周,总共50堂课。从零垒一套能上生产的完整技术栈:
1️⃣ 先建认知模型,吃透Decode为什么撑爆显存、Prefill为什么吃满算力
2️⃣ 硬啃vLLM源码,PagedAttention和调度器核心逻辑一个不跳
3️⃣ 上Prom ...
一个项目能拿 4 万+ Star,确实有点东西。
一个项目能拿 4 万+ Star,确实有点东西。
free-claude-code 更像一个统一的 AI 编程入口,可以把 Claude Code、Codex 等工具接到不同模型服务上。
NVIDIA NIM、OpenRouter、Gemini 等多种模型都能切换,云端、本地模型都支持。
还提供可视化管理界面,以及语音、Discord、Telegram 等接入方式。
如果你经常折腾各种 AI ...
Codex 提示:一套由 Astra 编排、兼顾成本效益的 Luna + Sol 智能体工作流。
Codex 提示:一套由 Astra 编排、兼顾成本效益的 Luna + Sol 智能体工作流。
在确定工作强度时,综合考量了 DeepSWE 的通过率、单任务平均成本以及智能体执行步骤。请将此方案交给 Codex 进行配置 👇
OpenAI大善人啊!这才是授人以渔!!
OpenAI大善人啊!这才是授人以渔!!
简直是保姆级教程,教会你怎么用image 2.5生成自己想要的图!!
OpenAI 刚刚发布了一份非常详细的 GPT Image 2.5 Prompt 指南,而且完全免费!
这份指南把图片生成和编辑时,提示词到底该怎么写,讲得非常清楚。
其中一个很重要的原则是:
先说清楚你最终想要什么,再描述画面细节。
...
用过了最新的 GPT-6 Astra 和 DeepSeek V4.1 Flash 之后,毫无疑问,这两个现在是我的主力了。所以重新更新了一下我的 AI 员工列表:
用过了最新的 GPT-6 Astra 和 DeepSeek V4.1 Flash 之后,毫无疑问,这两个现在是我的主力了。所以重新更新了一下我的 AI 员工列表:
1. 主力一号(搬砖工):Pi Agent + GPT-6 Astra Low
2. 主力二号(创作家):Pi Agent + DeepSeek V4.1 Flash + High
3. 备胎:Pi Agent + GLM 5.3 Flash + High
...
运维和后端桌面常年挂着五六个软件的痛,谁懂?
运维和后端桌面常年挂着五六个软件的痛,谁懂?
连服务器开 SSH,传文件切 SFTP,查数据开 Navicat 或 DBeaver,顺带还得挂着监控和远程桌面,Alt + Tab 都要按冒烟了。
刚发现一个硬核开源神器 Navop,直接把整个运维工作流塞进了一个客户端:
多端集成:SSH、SFTP、终端、服务器性能监控、远程桌面(RDP)一站式搞定
...