Gemini 3.1 Flash TTS正式推出,谷歌最新的文本转语音模型,支持场景指令、说话人级别的精细控制、音频标签、更自然且更富表现力的声音,以及 70 种不同语言。
Gemini 3.1 Flash TTS正式推出,谷歌最新的文本转语音模型,支持场景指令、说话人级别的精细控制、音频标签、更自然且更富表现力的声音,以及 70 种不同语言。
现已在 AI Studio 的全新音频 Playground 和 Gemini API 中上线!
http://t.cn/AXMrfgfq
...
推荐GitHub 上面的这个项目:vibecodingcn -- vibe指南
【推荐GitHub 上面的这个项目:vibecodingcn -- vibe指南】
地址:
它不教你怎么写代码,是教你怎么调教 AI
针对的就是AI 开发项目,开头猛如虎,越开越像二百五的痛点。解决 AI输出质量随项目推进下降的问题。
当然,这个只适合我们这些小白,训练编程思维和指令标准化,如果是大型项目,这个还是不够用的。(大神别喷 ...
在玩这个项目:Claude-Code-Game-Studios,一个可实现游戏开发全流程的 Claude Code 游戏开发框架
在玩这个项目:Claude-Code-Game-Studios,一个可实现游戏开发全流程的 Claude Code 游戏开发框架
本来以为是个高 🌟 网红项目,没想到有点意思
看着它的 49 个 agents 和 72 个 skills,我陷入了沉思
整个操作流程也基本是做选择题,我除了提供一个想法之外,好像没干啥[捂嘴哭]
链接:github.com/Donchitos/Claude-Co ...
千问上线表格Agent:对话直接生成、编辑Excel文
【千问上线表格Agent:对话直接生成、编辑Excel文】 钛媒体App 4月14日消息,千问上线“表格Agent”,支持在对话中直接生成、编辑Excel文件。用户可以要求千问检索信息后生成表格,也可以将多轮对话内容整理为表格,或基于图片、文件生成。系统通常可在1–2分钟内输出可下载的Excel文件,无需二次复制粘贴,并支持通过自然 ...
Vercel 开源了一个云端的 coding agent :Open Agents 链接:open-agents.dev
Vercel 开源了一个云端的 coding agent :Open Agents
链接:open-agents.dev
http://t.cn/AXMH7kLF
Paperclip 实力还是很强!比爆火的 Hermes 晚发布几天
Paperclip 实力还是很强!比爆火的 Hermes 晚发布几天,全程没搞铺天盖地的运营造势,GitHub 星星已经冲到 52k 了;反观全网刷屏的 Hermes,到现在也才 63k。
推荐一个开源项目 电子书下载宝库,一个收录了超过 800 个分类的电子书导航合集。
推荐一个开源项目 电子书下载宝库,一个收录了超过 800 个分类的电子书导航合集。
它从各大电子书网站整理汇总资源,按常用标签分类,每本书基本都提供 epub、mobi、azw3 三种格式下载
项目地址:jbiaojerry.github.io/ebook-treasure-chest/
GitHub:github.com/jbiaojerry/ebook-treasure-chest
##
...
FPV Ventures 合伙人 Nikunj Kothari (nikunj) 推出了 LLMwiki,一个完全开源的个人知识库项目
FPV Ventures 合伙人 Nikunj Kothari (nikunj) 推出了 LLMwiki,一个完全开源的个人知识库项目,灵感来自 Karpathy 和 FarzaTV。输入源包括推文、书签、iMessage/WhatsApp 和所有个人写作,用 Opus 4.5 完全 vibe coded,项目已开源在 GitHub 上。
传送门地址:github.com/kothari-nikunj/llm-wiki
##
...
4月初,京东探索研究院正式对外开源自研的JoyAI-Image-Edit图像模型。
4月初,京东探索研究院正式对外开源自研的JoyAI-Image-Edit图像模型。
代码已经放在GitHub上,以Apache 2.0协议释出,推理代码全部开放,开发者可以直接拿去做应用。
目前,系统已完成对ComfyUI的支持,并全面兼容Diffusers格式的模型权重与推理流程,方便开发者进行灵活部署与二次开发。
链接:http://t.cn/AXIu5FSe
...
想做短视频副业,但不想每晚熬夜剪片
想做短视频副业,但不想每晚熬夜剪片
与其开会员堆一堆软件,不如直接试试这四个能串起工作流的Github项目
从生成、剪辑、翻译到多平台发布
1、视频生成:MoneyPrinterTurbo
输入一个主题,就能先把文案、配音、字幕和素材初稿跑出来,适合快速搭建一条视频框架。
🔗:github.com/harry0703/Mone…
2、视频剪辑:FunCl ...
Anthropic 最近算力成本真是顶不住了,疯狂降成本
Anthropic 最近算力成本真是顶不住了,疯狂降成本
昨晚又推出了advisor tool,Sonnet 和 Haiku 这种小模型执行任务的时候,可以调用 Opus 这种大模型介入指导。
有人说估计 Anthropic 也会用这种方式让我们访问 Mythos 模型。
因为这样用户无法直接访问模型,又能提高现有模型的能力水平。
既能大幅提高 Sonnet 和 Hai ...
哇,超级良心的开源项目。
哇,超级良心的开源项目。
那些需要花几百几千买的录屏软件,可以原地退休了。
Recordly 是一款桌面端开源录屏与编辑工具,专为产品演示,教程和讲解视频打造。
1、适用于 Mac/Windows/Linux 等平台。
2、支持光标缩放,运动模糊,点击弹跳,自动字幕,时间线拖拽编辑等一系列功能。
3、还支持摄像头叠加和画面样式,导 ...
🚀 🔥 24 小时 GitHub 趋势爆款!
🚀 🔥 24 小时 GitHub 趋势爆款!
🔥 GitHub AI Agent 项目最新 Top 10(按 24h 星标增量排序):
1️⃣NousResearch/hermes-agent
定位:个人成长型 Agent(“The agent that grows with you”)。
亮点:支持长期记忆、自我进化、多任务编排,像“会升级的私人 AI 助手”。
场景:一人公司/个人用户长期陪伴式任务(代 ...
你应该知道的12个Git命令 掌握这些命令,让你的代码管理更加得心应手!
你应该知道的12个Git命令
掌握这些命令,让你的代码管理更加得心应手!
##
手机离线跑大模型!谷歌Gemma 4开源杀疯了🔥
手机离线跑大模型!谷歌Gemma 4开源杀疯了🔥
AI圈又炸场!谷歌刚开源Gemma 4系列,31B版本直接登顶开源榜,小参数打赢大模型,手机端就能离线全模态运行✨
轻量化王者,内存占用大砍,推理速度狂飙,图文理解、代码能力拉满,个人开发者与中小企业狂喜💻
不用挤云端、不用高算力,本地就能玩转强AI,彻底打破参数内 ...
推荐一个开源项目 Moyin-Creator,一款面向影视内容生产的 AI 工具。
推荐一个开源项目 Moyin-Creator,一款面向影视内容生产的 AI 工具。
它提供了从 剧本到成片的全流程批量化能力,适合用来快速生成视频内容、短片、自动剪辑等。项目支持 Seedance 2.0,利用现代 AI 模型来辅助影视素材生成与处理,大幅降低手动制作成本。
GitHub:github.com/MemeCalculate/moyin-creator
##
...
🚀 HappyHorse 1.0 科普教学:开源 AI 视频生成模型来了!
🚀 HappyHorse 1.0 科普教学:开源 AI 视频生成模型来了!
2026年4月8日,一匹“快乐小马”突然杀入 AI 视频生成赛道!🎬
在 Artificial Analysis Video Arena榜单上以 Elo 1333+登顶,超越 Seedance 2.0、Kling 3.0,成为全球首个公开宣称开源、联合生成视频+音频的 SOTA 模型。
💡 HappyHorse 1.0 最大特点
* 开源 ...
如果你用Gemini生成图像,必须知道这个宝藏。
如果你用Gemini生成图像,必须知道这个宝藏。
推荐'Awesome Nano Banana Pro Prompts':超过8000个精选提示词集合,为谷歌新模型量身定制。
地址:github.com/YouMind-OpenLab/awesome-nano-banana-pro-prompts
##
面壁智能2B小模型VoxCPM 2惊艳开源,一众外国网友疯狂了!30种语言与9大方言它是信手拈来
面壁智能2B小模型VoxCPM 2惊艳开源,一众外国网友疯狂了!30种语言与9大方言它是信手拈来
体验链接:
http://t.cn/AXMLDnaE
GitHub开源链接:
http://t.cn/AXMyyLcQ
Hugging Face链接:
http://t.cn/AXMyyLc8
http://t.cn/AXMyyMPB
✨ AI常常被视为一个“黑盒子”,但每一个智能系统背后都隐藏着一个结构精密的架构
#人工智能#
✨ AI常常被视为一个“黑盒子”,但每一个智能系统背后都隐藏着一个结构精密的架构——从原始硬件到最终应用如聊天机器人和AI助手!我整理了这个七层分解(参考上传的图片),帮你揭秘AI系统是如何构建、训练并在规模上部署的。
🟥 𝟭. 物理层(硬件与基础设施)
AI执行的基础——使用GPU(如NVIDIA、AM ...