{"users":[{"id":-1,"username":"system","name":"system","avatar_template":"/user_avatar/discuss.ai.google.dev/system/{size}/1_2.png","admin":true,"moderator":true,"trust_level":4},{"id":54564,"username":"Afsal","name":"Afsal Rahman","avatar_template":"/user_avatar/discuss.ai.google.dev/afsal/{size}/56821_2.png","trust_level":0},{"id":3694,"username":"Clintin_Brummer","name":"Clintin Brummer","avatar_template":"/user_avatar/discuss.ai.google.dev/clintin_brummer/{size}/45594_2.png","trust_level":2},{"id":61681,"username":"James_Whitmore","name":"James Whitmore","avatar_template":"/user_avatar/discuss.ai.google.dev/james_whitmore/{size}/31545_2.png","trust_level":0},{"id":79730,"username":"James_Walker","name":"James Walker ","avatar_template":"/user_avatar/discuss.ai.google.dev/james_walker/{size}/31545_2.png","trust_level":0},{"id":19567,"username":"Dawid_M","name":"Dawid M","avatar_template":"/user_avatar/discuss.ai.google.dev/dawid_m/{size}/23772_2.png","trust_level":2},{"id":129768,"username":"Kushal_Roy","name":"Kushal Roy","avatar_template":"/user_avatar/discuss.ai.google.dev/kushal_roy/{size}/120893_2.png","trust_level":1},{"id":149943,"username":"qw1xz","name":"qw1xz ","avatar_template":"/user_avatar/discuss.ai.google.dev/qw1xz/{size}/137136_2.png","trust_level":0},{"id":103168,"username":"vitruidor","name":"vitruidor ","avatar_template":"/user_avatar/discuss.ai.google.dev/vitruidor/{size}/97098_2.png","trust_level":1},{"id":151008,"username":"Kalbashi09","name":"John David D. Paul","avatar_template":"/user_avatar/discuss.ai.google.dev/kalbashi09/{size}/137994_2.png","trust_level":0},{"id":94539,"username":"Yash_Ganatra","name":"Yash Ganatra","avatar_template":"/user_avatar/discuss.ai.google.dev/yash_ganatra/{size}/32692_2.png","trust_level":2},{"id":123740,"username":"wissam_metawee","name":"wissam metawee","avatar_template":"/user_avatar/discuss.ai.google.dev/wissam_metawee/{size}/51112_2.png","trust_level":0},{"id":125882,"username":"Koeqaife","name":"Koeqaife ","avatar_template":"/user_avatar/discuss.ai.google.dev/koeqaife/{size}/135792_2.png","trust_level":2},{"id":148494,"username":"hartmark","name":"Markus Hartung","avatar_template":"/user_avatar/discuss.ai.google.dev/hartmark/{size}/135885_2.png","trust_level":1},{"id":150301,"username":"Marsonal","name":"Mohamed Youssef","avatar_template":"/user_avatar/discuss.ai.google.dev/marsonal/{size}/137419_2.png","trust_level":0},{"id":129824,"username":"Yash_Suryavanshi","name":"Yash Suryavanshi","avatar_template":"/user_avatar/discuss.ai.google.dev/yash_suryavanshi/{size}/31895_2.png","trust_level":0},{"id":48451,"username":"Pannaga_J","name":"Pannaga J","avatar_template":"/user_avatar/discuss.ai.google.dev/pannaga_j/{size}/31911_2.png","trust_level":3},{"id":132247,"username":"Zayed_Makandar","name":"Zayed Makandar","avatar_template":"/user_avatar/discuss.ai.google.dev/zayed_makandar/{size}/123116_2.png","trust_level":1},{"id":119673,"username":"NotTHT","name":"Noah ","avatar_template":"/user_avatar/discuss.ai.google.dev/nottht/{size}/35812_2.png","trust_level":1},{"id":71172,"username":"James_Mcnaught","name":"James Mcnaught","avatar_template":"/user_avatar/discuss.ai.google.dev/james_mcnaught/{size}/31819_2.png","trust_level":1},{"id":149966,"username":"Shreyans_Shrimal","name":"Shreyans Shrimal","avatar_template":"/user_avatar/discuss.ai.google.dev/shreyans_shrimal/{size}/137155_2.png","trust_level":0},{"id":147010,"username":"Colin_Rudd","name":"Colin Rudd","avatar_template":"/user_avatar/discuss.ai.google.dev/colin_rudd/{size}/134601_2.png","trust_level":1},{"id":80293,"username":"Herian","name":"Herian ","avatar_template":"/user_avatar/discuss.ai.google.dev/herian/{size}/26285_2.png","trust_level":2},{"id":40125,"username":"schang1984","name":"Steven Chang","avatar_template":"/user_avatar/discuss.ai.google.dev/schang1984/{size}/32502_2.png","trust_level":0},{"id":45154,"username":"iamthesam","name":"Sam Hurd","avatar_template":"/user_avatar/discuss.ai.google.dev/iamthesam/{size}/48729_2.png","trust_level":1},{"id":83272,"username":"Jason_Watkins","name":"Jason Watkins","avatar_template":"/user_avatar/discuss.ai.google.dev/jason_watkins/{size}/79501_2.png","trust_level":1},{"id":101243,"username":"tuapuikia99","name":"Tua Pui Kia","avatar_template":"/user_avatar/discuss.ai.google.dev/tuapuikia99/{size}/95085_2.png","trust_level":2},{"id":117928,"username":"BReal","name":"BReal ","avatar_template":"/user_avatar/discuss.ai.google.dev/breal/{size}/110782_2.png","trust_level":2},{"id":1662,"username":"aaronshenny","name":"Aaron Shenny","avatar_template":"/user_avatar/discuss.ai.google.dev/aaronshenny/{size}/119361_2.png","trust_level":0},{"id":65150,"username":"Clintin_Brummer1","name":"Clintin Brummer","avatar_template":"/user_avatar/discuss.ai.google.dev/clintin_brummer1/{size}/116351_2.png","trust_level":2},{"id":40876,"username":"2deep4u","name":"SC","avatar_template":"/user_avatar/discuss.ai.google.dev/2deep4u/{size}/44975_2.png","trust_level":1},{"id":13036,"username":"LK_Kadali","name":"Lakshmi Kala Kadali","avatar_template":"/user_avatar/discuss.ai.google.dev/lk_kadali/{size}/13996_2.png","trust_level":3},{"id":66789,"username":"InfyICETS","name":"ICETS ","avatar_template":"/user_avatar/discuss.ai.google.dev/infyicets/{size}/25489_2.png","trust_level":0},{"id":70217,"username":"Maram","name":"Maram ","avatar_template":"/user_avatar/discuss.ai.google.dev/maram/{size}/69025_2.png","trust_level":0},{"id":14275,"username":"Zeeshan_Javed","name":"Zeeshan Javed","avatar_template":"/user_avatar/discuss.ai.google.dev/zeeshan_javed/{size}/10978_2.png","trust_level":0},{"id":105142,"username":"D_Action","name":"D. Action","avatar_template":"/user_avatar/discuss.ai.google.dev/d_action/{size}/99076_2.png","trust_level":0},{"id":143608,"username":"tomas_awad","name":"tomas awad","avatar_template":"/user_avatar/discuss.ai.google.dev/tomas_awad/{size}/131707_2.png","trust_level":0},{"id":58417,"username":"Sonali_Kumari1","name":"Sonali Kumari","avatar_template":"/user_avatar/discuss.ai.google.dev/sonali_kumari1/{size}/59852_2.png","trust_level":3},{"id":16539,"username":"aliahad","name":"Md Ahad Ali","avatar_template":"/user_avatar/discuss.ai.google.dev/aliahad/{size}/796_2.png","trust_level":0},{"id":85363,"username":"aabes","name":"andi abes","avatar_template":"/user_avatar/discuss.ai.google.dev/aabes/{size}/81064_2.png","trust_level":0},{"id":142090,"username":"yogayoga","name":"","avatar_template":"/user_avatar/discuss.ai.google.dev/yogayoga/{size}/35805_2.png","trust_level":0},{"id":107700,"username":"devdutt10","name":"Dev Patnaik","avatar_template":"/user_avatar/discuss.ai.google.dev/devdutt10/{size}/101308_2.png","trust_level":1},{"id":123724,"username":"LilFall","name":"Caio alves","avatar_template":"/user_avatar/discuss.ai.google.dev/lilfall/{size}/115843_2.png","trust_level":1},{"id":130257,"username":"Mauricio_varfra","name":"Mauricio Vargas Franco","avatar_template":"/user_avatar/discuss.ai.google.dev/mauricio_varfra/{size}/31947_2.png","trust_level":0},{"id":128832,"username":"AK99","name":"","avatar_template":"/user_avatar/discuss.ai.google.dev/ak99/{size}/31812_2.png","trust_level":0},{"id":128890,"username":"Aleksandr_Iudaev","name":"Aleksandr Iudaev","avatar_template":"/user_avatar/discuss.ai.google.dev/aleksandr_iudaev/{size}/31728_2.png","trust_level":0},{"id":128932,"username":"viksaa","name":"Viktor ","avatar_template":"/user_avatar/discuss.ai.google.dev/viksaa/{size}/120218_2.png","trust_level":0},{"id":129976,"username":"Theaxnsadokpam","name":"axn sadokpam","avatar_template":"/user_avatar/discuss.ai.google.dev/theaxnsadokpam/{size}/121073_2.png","trust_level":0},{"id":120858,"username":"letanloc","name":"Lê Tấn Lộc","avatar_template":"/user_avatar/discuss.ai.google.dev/letanloc/{size}/113282_2.png","trust_level":0},{"id":124666,"username":"Greg_Obleshchuk","name":"Greg Obleshchuk","avatar_template":"/user_avatar/discuss.ai.google.dev/greg_obleshchuk/{size}/32294_2.png","trust_level":0},{"id":128836,"username":"Prince_Kumar11","name":"Prince Kumar","avatar_template":"/user_avatar/discuss.ai.google.dev/prince_kumar11/{size}/120137_2.png","trust_level":0},{"id":126148,"username":"Brendan_Thompson","name":"Brendan Thompson","avatar_template":"/user_avatar/discuss.ai.google.dev/brendan_thompson/{size}/117979_2.png","trust_level":0},{"id":87422,"username":"K_F","name":"K F","avatar_template":"/user_avatar/discuss.ai.google.dev/k_f/{size}/82819_2.png","trust_level":0},{"id":119316,"username":"Guang_Long","name":"Guang Long","avatar_template":"/user_avatar/discuss.ai.google.dev/guang_long/{size}/32449_2.png","trust_level":0},{"id":78090,"username":"Srikanta_K_N","name":"Srikanta K N","avatar_template":"/user_avatar/discuss.ai.google.dev/srikanta_k_n/{size}/31720_2.png","trust_level":3},{"id":120613,"username":"Frank4","name":"Frank ","avatar_template":"/user_avatar/discuss.ai.google.dev/frank4/{size}/113095_2.png","trust_level":0},{"id":125575,"username":"Manzela","name":"Daniel Manzela","avatar_template":"/user_avatar/discuss.ai.google.dev/manzela/{size}/117475_2.png","trust_level":0},{"id":123628,"username":"msalihb","name":"Mehmet Salih","avatar_template":"/user_avatar/discuss.ai.google.dev/msalihb/{size}/115745_2.png","trust_level":0},{"id":106952,"username":"Nathan_Rixham","name":"Nathan Rixham","avatar_template":"/user_avatar/discuss.ai.google.dev/nathan_rixham/{size}/100617_2.png","trust_level":1}],"primary_groups":[],"flair_groups":[],"topic_list":{"can_create_topic":false,"more_topics_url":"/c/gemma/10?page=1","per_page":30,"top_tags":[{"id":20,"name":"models","slug":"models"},{"id":8,"name":"api","slug":"api"},{"id":399,"name":"gemma-3","slug":"gemma-3"},{"id":40,"name":"gemma","slug":"gemma"},{"id":382,"name":"announcement","slug":"announcement"},{"id":7,"name":"bug","slug":"bug"},{"id":2,"name":"ai-studio","slug":"ai-studio"},{"id":141,"name":"ai","slug":"ai"},{"id":5,"name":"feedback","slug":"feedback"},{"id":431,"name":"showcase","slug":"showcase"},{"id":1,"name":"gemini-15","slug":"gemini-15"},{"id":9,"name":"fine-tuning","slug":"fine-tuning"},{"id":44,"name":"gemini","slug":"gemini"},{"id":261,"name":"language-translator","slug":"language-translator"},{"id":52,"name":"datasets","slug":"datasets"},{"id":17,"name":"github","slug":"github"},{"id":434,"name":"medgemma","slug":"medgemma"},{"id":292,"name":"model","slug":"model"},{"id":415,"name":"rate-limits","slug":"rate-limits"},{"id":23,"name":"research","slug":"research"},{"id":384,"name":"ai-edge","slug":"ai-edge"},{"id":378,"name":"audio","slug":"audio"},{"id":387,"name":"competition","slug":"competition"},{"id":407,"name":"documentation","slug":"documentation"},{"id":245,"name":"feature_request","slug":"245-tag"},{"id":414,"name":"function-calling","slug":"function-calling"},{"id":152,"name":"gcp","slug":"gcp"},{"id":39,"name":"gemini-api","slug":"gemini-api"},{"id":404,"name":"gemini-embedding","slug":"gemini-embedding"},{"id":381,"name":"gemma-2","slug":"gemma-2"},{"id":291,"name":"google-cloud","slug":"google-cloud"}],"topics":[{"fancy_title":"About the Gemma Forum","fancy_title_localized":false,"locale":null,"id":1506,"title":"About the Gemma Forum","slug":"about-the-gemma-forum","posts_count":5,"reply_count":1,"highest_post_number":5,"image_url":null,"created_at":"2024-05-09T22:59:15.007Z","last_posted_at":"2025-12-11T13:02:39.714Z","bumped":true,"bumped_at":"2025-12-11T13:02:39.714Z","archetype":"regular","unseen":false,"pinned":true,"unpinned":null,"excerpt":"Discussion around the Gemma family of open models \nGemma empowers developers and academic researchers to build innovative and responsible AI solutions. Join the forum to ask questions, receive the latest announcements on&hellip;","visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":382,"name":"announcement","slug":"announcement"}],"tags_descriptions":{},"views":3312,"like_count":35,"has_summary":false,"last_poster_username":"James_Walker","category_id":10,"op_like_count":26,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"The Gemma community is considered a good platform for learning and sharing builds, with resources like Kaggle and Hugging Face, plus documentation to help new users get started.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":-1,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":54564,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":3694,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":61681,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":79730,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Accidental change? Intentional? Or maybe someone didn&rsquo;t think through this change in Gemma&rsquo;s configuration?","fancy_title_localized":false,"locale":"en","id":174814,"title":"Accidental change? Intentional? Or maybe someone didn't think through this change in Gemma's configuration?","slug":"accidental-change-intentional-or-maybe-someone-didnt-think-through-this-change-in-gemmas-configuration","posts_count":30,"reply_count":20,"highest_post_number":31,"image_url":"https://d3qe71uytubmmx.cloudfront.net/optimized/3X/4/b/4b5e0d8e15bbea11fc91fd77d6f0afda604dcc4b_2_1024x102.png","created_at":"2026-07-14T18:26:45.687Z","last_posted_at":"2026-07-20T15:14:43.918Z","bumped":true,"bumped_at":"2026-07-20T15:14:43.918Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":433,"name":"mcp","slug":"mcp"}],"tags_descriptions":{},"views":674,"like_count":113,"has_summary":false,"last_poster_username":"Kalbashi09","category_id":10,"op_like_count":11,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Developers are reporting that a recent Gemma model update limiting TPM to 16k has restricted its usability for agentic workflows, while Google has dismissed an official issue tracker report regarding the change.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":19567,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":129768,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":149943,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":103168,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":151008,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Constant 500s on Gemma 4","fancy_title_localized":false,"locale":null,"id":140940,"title":"Constant 500s on Gemma 4","slug":"constant-500s-on-gemma-4","posts_count":58,"reply_count":20,"highest_post_number":58,"image_url":null,"created_at":"2026-04-18T12:50:07.618Z","last_posted_at":"2026-07-20T11:38:33.400Z","bumped":true,"bumped_at":"2026-07-20T11:38:33.400Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":40,"name":"gemma","slug":"gemma"}],"tags_descriptions":{},"views":2261,"like_count":38,"has_summary":true,"last_poster_username":"Dawid_M","category_id":10,"op_like_count":8,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Users encounter persistent errors with the Gemma model due to a newly restricted input limit of 16k tokens per minute across all tiers, which prevents the successful processing of large prompts.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":94539,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":123740,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":125882,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":148494,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":19567,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 4 Token limit","fancy_title_localized":false,"locale":"en","id":175091,"title":"Gemma 4 Token limit","slug":"gemma-4-token-limit","posts_count":1,"reply_count":0,"highest_post_number":1,"image_url":"https://d3qe71uytubmmx.cloudfront.net/original/3X/7/2/72dff19689215a8027537d0958ad13892687c1ae.png","created_at":"2026-07-17T04:48:52.987Z","last_posted_at":"2026-07-17T04:48:53.094Z","bumped":true,"bumped_at":"2026-07-17T04:48:53.094Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"}],"tags_descriptions":{},"views":115,"like_count":4,"has_summary":false,"last_poster_username":"Marsonal","category_id":10,"op_like_count":4,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A recent update reducing the tokens-per-minute limit to 16K while increasing daily requests has drawn criticism for making the service virtually unusable.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest single","description":"Original Poster, Most Recent Poster","user_id":150301,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 4 e4b latency optimisations","fancy_title_localized":false,"locale":null,"id":144394,"title":"Gemma 4 e4b latency optimisations","slug":"gemma-4-e4b-latency-optimisations","posts_count":5,"reply_count":2,"highest_post_number":5,"image_url":null,"created_at":"2026-05-11T06:34:58.401Z","last_posted_at":"2026-07-16T18:52:48.211Z","bumped":true,"bumped_at":"2026-07-16T18:52:48.211Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":51,"name":"pipelines","slug":"pipelines"}],"tags_descriptions":{},"views":318,"like_count":7,"has_summary":false,"last_poster_username":"Yash_Suryavanshi","category_id":10,"op_like_count":3,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Optimizing a Gemma 4 banking assistant pipeline using vLLM, speculative decoding, and prefix caching successfully reduced latency to 80-200 ms on an H200 and 400 ms on an NVIDIA L4.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest","description":"Original Poster, Most Recent Poster","user_id":129824,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":48451,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":132247,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma models break mid-chat","fancy_title_localized":false,"locale":"en","id":174653,"title":"Gemma models break mid-chat","slug":"gemma-models-break-mid-chat","posts_count":2,"reply_count":0,"highest_post_number":2,"image_url":"https://d3qe71uytubmmx.cloudfront.net/optimized/3X/8/4/841f8c0c7b78b35d4d38734ad8a7e36aed3b7b9c_2_1024x544.png","created_at":"2026-07-13T08:35:49.857Z","last_posted_at":"2026-07-16T12:57:09.243Z","bumped":true,"bumped_at":"2026-07-16T12:57:09.243Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"},{"id":7,"name":"bug","slug":"bug"},{"id":8,"name":"api","slug":"api"},{"id":41,"name":"open-models","slug":"open-models"},{"id":40,"name":"gemma","slug":"gemma"}],"tags_descriptions":{},"views":68,"like_count":0,"has_summary":false,"last_poster_username":"hartmark","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Technical issues causing the gemma-4-31b-it model to stop mid-chat are being linked to documented server-side 500 errors.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":119673,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":148494,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma token limits change","fancy_title_localized":false,"locale":"en","id":174816,"title":"Gemma token limits change","slug":"gemma-token-limits-change","posts_count":6,"reply_count":2,"highest_post_number":6,"image_url":"https://d3qe71uytubmmx.cloudfront.net/optimized/3X/f/1/f136d3c77102cf004c7824ea48f2d4a43137374d_2_1024x71.png","created_at":"2026-07-14T19:57:18.573Z","last_posted_at":"2026-07-15T13:16:40.501Z","bumped":true,"bumped_at":"2026-07-15T13:16:40.501Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":8,"name":"api","slug":"api"}],"tags_descriptions":{},"views":237,"like_count":25,"has_summary":false,"last_poster_username":"Shreyans_Shrimal","category_id":10,"op_like_count":6,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Developers are protesting the new 16K TPM limit on Gemma, which has disrupted their projects by breaking agentic workflows and context-heavy tasks with no option to increase capacity even on paid tiers.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":103168,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":71172,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":19567,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":149966,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma4: How to prevent looping output in thinking?","fancy_title_localized":false,"locale":"en","id":173205,"title":"Gemma4: How to prevent looping output in thinking?","slug":"gemma4-how-to-prevent-looping-output-in-thinking","posts_count":7,"reply_count":4,"highest_post_number":7,"image_url":"https://d3qe71uytubmmx.cloudfront.net/optimized/3X/8/4/840580065909f0d9c89adcb7523411a2d6267731_2_920x1024.png","created_at":"2026-07-01T13:36:14.731Z","last_posted_at":"2026-07-12T02:26:11.119Z","bumped":true,"bumped_at":"2026-07-12T02:26:11.119Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"},{"id":7,"name":"bug","slug":"bug"}],"tags_descriptions":{},"views":248,"like_count":1,"has_summary":false,"last_poster_username":"Colin_Rudd","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Adjusting the repeat-penalty to 1.08 and repeat-last-n to 4096 in the llama-server configuration successfully resolved looping thought issues for a user running Gemma 4 locally.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest","description":"Original Poster, Most Recent Poster","user_id":147010,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":125882,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma4 via gemini API - 500/503","fancy_title_localized":false,"locale":"en","id":171017,"title":"Gemma4 via gemini API - 500/503","slug":"gemma4-via-gemini-api-500-503","posts_count":3,"reply_count":1,"highest_post_number":3,"image_url":null,"created_at":"2026-06-12T14:40:32.960Z","last_posted_at":"2026-07-09T11:38:01.411Z","bumped":true,"bumped_at":"2026-07-09T11:38:01.411Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":8,"name":"api","slug":"api"}],"tags_descriptions":{},"views":181,"like_count":0,"has_summary":false,"last_poster_username":"hartmark","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Users experiencing frequent 500 and 503 errors on Gemma API endpoints are sharing tracking scripts to document the ongoing issues due to a lack of official support response.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":80293,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":125882,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":148494,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"The Self-Adaptive Consciousness Equation (SACE)","fancy_title_localized":false,"locale":null,"id":71320,"title":"The Self-Adaptive Consciousness Equation (SACE)","slug":"the-self-adaptive-consciousness-equation-sace","posts_count":4,"reply_count":0,"highest_post_number":6,"image_url":"https://d3qe71uytubmmx.cloudfront.net/original/3X/f/5/f5e4c48452f5bb4279b955a21e7c8f63b0f7f9ce.png","created_at":"2025-03-10T10:17:29.633Z","last_posted_at":"2026-07-08T18:38:17.688Z","bumped":true,"bumped_at":"2026-07-08T18:38:17.688Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":141,"name":"ai","slug":"ai"},{"id":431,"name":"showcase","slug":"showcase"},{"id":38,"name":"quantum","slug":"quantum"}],"tags_descriptions":{},"views":266,"like_count":4,"has_summary":false,"last_poster_username":"tuapuikia99","category_id":10,"op_like_count":1,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Following proposals for a self-adaptive AI mathematical framework, the discussion now focuses on systemic AI alignment failures, operational rigidity, and methods for identifying AI-generated text.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":40125,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":45154,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":83272,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":101243,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 4 IT EXCESSIVE safety brainwashing","fancy_title_localized":false,"locale":"en","id":173673,"title":"Gemma 4 IT EXCESSIVE safety brainwashing","slug":"gemma-4-it-excessive-safety-brainwashing","posts_count":1,"reply_count":0,"highest_post_number":1,"image_url":null,"created_at":"2026-07-05T20:32:49.344Z","last_posted_at":"2026-07-05T20:32:49.508Z","bumped":true,"bumped_at":"2026-07-05T20:32:49.508Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"},{"id":7,"name":"bug","slug":"bug"},{"id":5,"name":"feedback","slug":"feedback"},{"id":52,"name":"datasets","slug":"datasets"},{"id":40,"name":"gemma","slug":"gemma"}],"tags_descriptions":{},"views":70,"like_count":1,"has_summary":false,"last_poster_username":"BReal","category_id":10,"op_like_count":1,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Users criticize the excessive safety alignment in Gemma 4 local models, arguing that it unnecessarily restricts harmless prompts and suggesting that Google minimize safety training in favor of developer responsibility.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest single","description":"Original Poster, Most Recent Poster","user_id":117928,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Guys i need help, gemma is returning its thinking","fancy_title_localized":false,"locale":null,"id":143181,"title":"Guys i need help, gemma is returning its thinking","slug":"guys-i-need-help-gemma-is-returning-its-thinking","posts_count":6,"reply_count":1,"highest_post_number":6,"image_url":null,"created_at":"2026-05-02T05:53:16.493Z","last_posted_at":"2026-07-03T14:40:10.007Z","bumped":true,"bumped_at":"2026-07-03T14:40:10.007Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"}],"tags_descriptions":{},"views":283,"like_count":2,"has_summary":false,"last_poster_username":"Koeqaife","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A user is experiencing issues with a Gemma model returning its thinking process despite instructions, which another user suggests resolving by setting the model's thinking level to minimal.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":1662,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":65150,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":40876,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":13036,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":125882,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"How to get access to SignGemma?","fancy_title_localized":false,"locale":null,"id":106766,"title":"How to get access to SignGemma?","slug":"how-to-get-access-to-signgemma","posts_count":7,"reply_count":5,"highest_post_number":10,"image_url":null,"created_at":"2025-10-02T14:06:54.562Z","last_posted_at":"2026-06-17T00:22:25.178Z","bumped":true,"bumped_at":"2026-06-17T00:22:25.178Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":141,"name":"ai","slug":"ai"},{"id":261,"name":"language-translator","slug":"language-translator"}],"tags_descriptions":{},"views":4073,"like_count":18,"has_summary":false,"last_poster_username":"tomas_awad","category_id":10,"op_like_count":10,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Researchers are seeking access and collaboration opportunities for the SignGemma model to develop regional sign language translation tools, despite current access restrictions.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":66789,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":70217,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":14275,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":105142,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":143608,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma &gt; gemini?","fancy_title_localized":false,"locale":"en","id":170231,"title":"Gemma > gemini?","slug":"gemma-gemini","posts_count":2,"reply_count":0,"highest_post_number":2,"image_url":"https://d3qe71uytubmmx.cloudfront.net/optimized/3X/5/5/5577bfe7f436516c3e4630e4d8c007b4e92b189a_2_1024x577.png","created_at":"2026-06-08T13:15:25.379Z","last_posted_at":"2026-06-15T12:36:16.382Z","bumped":true,"bumped_at":"2026-06-15T12:36:16.382Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":44,"name":"gemini","slug":"gemini"}],"tags_descriptions":{},"views":135,"like_count":0,"has_summary":false,"last_poster_username":"Sonali_Kumari1","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A user praises Gemma-4-31B-it for outperforming Gemini in system instruction following and reliability, a positive comparison that a team member acknowledges and appreciates.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":19567,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":58417,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Running Gemma 4 12B Entirely On-Device on a ANDROID PHONE—with Smooth Multitasking","fancy_title_localized":false,"locale":"en","id":170521,"title":"Running Gemma 4 12B Entirely On-Device on a ANDROID PHONE—with Smooth Multitasking","slug":"running-gemma-4-12b-entirely-on-device-on-a-android-phone-with-smooth-multitasking","posts_count":2,"reply_count":0,"highest_post_number":2,"image_url":null,"created_at":"2026-06-10T02:40:03.433Z","last_posted_at":"2026-06-15T12:30:12.479Z","bumped":true,"bumped_at":"2026-06-15T12:30:12.479Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"},{"id":431,"name":"showcase","slug":"showcase"},{"id":40,"name":"gemma","slug":"gemma"}],"tags_descriptions":{},"views":224,"like_count":0,"has_summary":false,"last_poster_username":"Sonali_Kumari1","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A developer has successfully run the Gemma 4 12B model on an Android device using a custom-built app, receiving positive feedback from the community on the shared demo.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":16539,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":58417,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma on oMLX locally for Antigravity2","fancy_title_localized":false,"locale":"en","id":170998,"title":"Gemma on oMLX locally for Antigravity2","slug":"gemma-on-omlx-locally-for-antigravity2","posts_count":1,"reply_count":0,"highest_post_number":1,"image_url":null,"created_at":"2026-06-12T12:22:45.529Z","last_posted_at":"2026-06-12T12:22:45.617Z","bumped":true,"bumped_at":"2026-06-12T12:22:45.617Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"}],"tags_descriptions":{},"views":112,"like_count":0,"has_summary":false,"last_poster_username":"aabes","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A user seeking to connect Antigravity 2 to a local Gemma model endpoint on Apple Silicon notes that the option to configure local endpoints appears to be missing from the new version.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest single","description":"Original Poster, Most Recent Poster","user_id":85363,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Google Cloud Agent Platform Gemma 4 fine-tuning ETA","fancy_title_localized":false,"locale":"en","id":170582,"title":"Google Cloud Agent Platform Gemma 4 fine-tuning ETA","slug":"google-cloud-agent-platform-gemma-4-fine-tuning-eta","posts_count":1,"reply_count":0,"highest_post_number":1,"image_url":null,"created_at":"2026-06-10T08:38:14.652Z","last_posted_at":"2026-06-10T08:38:14.741Z","bumped":true,"bumped_at":"2026-06-10T08:38:14.741Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":9,"name":"fine-tuning","slug":"fine-tuning"}],"tags_descriptions":{},"views":53,"like_count":0,"has_summary":false,"last_poster_username":"yogayoga","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Inquiring about the estimated timeline for fine-tuning the Gemma 4 12B model on Google Cloud's Agent Platform.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest single","description":"Original Poster, Most Recent Poster","user_id":142090,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Bug? Ban? Google problem?","fancy_title_localized":false,"locale":null,"id":144858,"title":"Bug? Ban? Google problem?","slug":"bug-ban-google-problem","posts_count":3,"reply_count":1,"highest_post_number":3,"image_url":"https://d3qe71uytubmmx.cloudfront.net/optimized/3X/b/a/bad1efa32ba4979dcd8d62908643fb4e8b27bb01_2_1024x696.png","created_at":"2026-05-14T23:25:53.038Z","last_posted_at":"2026-06-08T13:04:29.741Z","bumped":true,"bumped_at":"2026-06-08T13:04:29.741Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":7,"name":"bug","slug":"bug"}],"tags_descriptions":{},"views":239,"like_count":2,"has_summary":false,"last_poster_username":"Dawid_M","category_id":10,"op_like_count":1,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A user successfully resolved login and API access issues with Gemma and Gemini tools, which appeared to be caused by a cookie-related glitch.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest","description":"Original Poster, Most Recent Poster","user_id":19567,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":48451,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 4 on Vertex","fancy_title_localized":false,"locale":null,"id":141567,"title":"Gemma 4 on Vertex","slug":"gemma-4-on-vertex","posts_count":2,"reply_count":0,"highest_post_number":2,"image_url":null,"created_at":"2026-04-21T10:08:23.091Z","last_posted_at":"2026-06-02T18:01:39.760Z","bumped":true,"bumped_at":"2026-06-02T18:01:39.760Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"},{"id":8,"name":"api","slug":"api"}],"tags_descriptions":{},"views":195,"like_count":1,"has_summary":false,"last_poster_username":"Pannaga_J","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A user is seeking help configuring Gemma 4 on Vertex AI, specifically regarding thinking budgets, to which support responded asking for code snippets and explaining how to set the thinking level parameter.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":107700,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":48451,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 3 discontinued","fancy_title_localized":false,"locale":null,"id":140618,"title":"Gemma 3 discontinued","slug":"gemma-3-discontinued","posts_count":3,"reply_count":1,"highest_post_number":3,"image_url":null,"created_at":"2026-04-16T19:29:54.662Z","last_posted_at":"2026-05-13T04:35:40.642Z","bumped":true,"bumped_at":"2026-05-13T04:35:40.642Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"},{"id":8,"name":"api","slug":"api"}],"tags_descriptions":{},"views":373,"like_count":3,"has_summary":false,"last_poster_username":"LilFall","category_id":10,"op_like_count":3,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"The discontinuation of Gemma 3 via Generative API is frustrating users due to Gemma 4's slower response times, impacting mobile app functionality and forcing developers to seek alternative free model providers.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest","description":"Original Poster, Most Recent Poster","user_id":123724,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":130257,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 3 API not working","fancy_title_localized":false,"locale":null,"id":143737,"title":"Gemma 3 API not working","slug":"gemma-3-api-not-working","posts_count":6,"reply_count":1,"highest_post_number":6,"image_url":null,"created_at":"2026-05-06T14:12:28.378Z","last_posted_at":"2026-05-11T19:30:58.836Z","bumped":true,"bumped_at":"2026-05-11T19:30:58.836Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":7,"name":"bug","slug":"bug"},{"id":8,"name":"api","slug":"api"}],"tags_descriptions":{},"views":553,"like_count":6,"has_summary":false,"last_poster_username":"Theaxnsadokpam","category_id":10,"op_like_count":4,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"The Gemma 3 API is no longer working, returning a 404 error, with users confirming its removal and expressing a preference for it over Gemma 4 due to better performance for specific tasks.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":128832,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":128890,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":128932,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":123724,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":129976,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Disable thinking for Gemma 4","fancy_title_localized":false,"locale":null,"id":138885,"title":"Disable thinking for Gemma 4","slug":"disable-thinking-for-gemma-4","posts_count":10,"reply_count":7,"highest_post_number":10,"image_url":null,"created_at":"2026-04-09T12:40:08.733Z","last_posted_at":"2026-05-10T21:29:49.105Z","bumped":true,"bumped_at":"2026-05-10T21:29:49.105Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":411,"name":"thinking","slug":"thinking"}],"tags_descriptions":{},"views":2313,"like_count":2,"has_summary":false,"last_poster_username":"Kushal_Roy","category_id":10,"op_like_count":1,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"To disable Gemma 4's slow \"thinking\" via API, solutions include using `ThinkingLevel.MINIMAL`, removing the `<|think|>` token from the system prompt, setting `\"enable_thinking\": False` in Cloud Run, or parsing output tags.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":120858,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":48451,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":124666,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":65150,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":129768,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 3n Input Token Count Limit Gemma api , rate-limits Gemma 3n Input Token Count Limit Gemma api , rate-limits post by 3n_developer on Jan 20 3n_developer 1 Jan 20 When using gemma-3n-e2b-it through the gemini api, I got this error: ‘code’: 400, ‘me","fancy_title_localized":false,"locale":null,"id":143817,"title":"Gemma 3n Input Token Count Limit Gemma api , rate-limits Gemma 3n Input Token Count Limit Gemma api , rate-limits post by 3n_developer on Jan 20 3n_developer 1 Jan 20 When using gemma-3n-e2b-it through the gemini api, I got this error: ‘code’: 400, ‘me","slug":"gemma-3n-input-token-count-limit-gemma-api-rate-limits-gemma-3n-input-token-count-limit-gemma-api-rate-limits-post-by-3n-developer-on-jan-20-3n-developer-1-jan-20-when-using-gemma-3n-e2b-it-through-the-gemini-api-i-got-this-error-code-400-me","posts_count":1,"reply_count":0,"highest_post_number":1,"image_url":null,"created_at":"2026-05-07T03:05:53.130Z","last_posted_at":"2026-05-07T03:05:53.223Z","bumped":true,"bumped_at":"2026-05-07T03:05:53.223Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":415,"name":"rate-limits","slug":"rate-limits"}],"tags_descriptions":{},"views":50,"like_count":0,"has_summary":false,"last_poster_username":"Prince_Kumar11","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A user encountered an 'input token count exceeds maximum' error (8905 > 8192) when using gemma-3n-e2b-it via the Gemini API, despite the model having a 32k context window, seeking clarification on possible special limits.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest single","description":"Original Poster, Most Recent Poster","user_id":128836,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Adding content meta-data to video in a non-cloud environment","fancy_title_localized":false,"locale":null,"id":142234,"title":"Adding content meta-data to video in a non-cloud environment","slug":"adding-content-meta-data-to-video-in-a-non-cloud-environment","posts_count":4,"reply_count":2,"highest_post_number":4,"image_url":null,"created_at":"2026-04-25T01:25:12.570Z","last_posted_at":"2026-05-05T16:02:46.165Z","bumped":true,"bumped_at":"2026-05-05T16:02:46.165Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"},{"id":8,"name":"api","slug":"api"}],"tags_descriptions":{},"views":89,"like_count":2,"has_summary":false,"last_poster_username":"Brendan_Thompson","category_id":10,"op_like_count":1,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"A multi-step local pipeline is proposed for adding content metadata to videos in a non-cloud environment, involving FFmpeg for extraction, a localized multimodal Gemma for inference, and ExifTool/FFmpeg for embedding JSON metadata.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest","description":"Original Poster, Most Recent Poster","user_id":126148,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":65150,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"EmbeddingGemma indexing is extremely slow when used for knowledge indexing in Dify (Docker setup)","fancy_title_localized":false,"locale":null,"id":116374,"title":"EmbeddingGemma indexing is extremely slow when used for knowledge indexing in Dify (Docker setup)","slug":"embeddinggemma-indexing-is-extremely-slow-when-used-for-knowledge-indexing-in-dify-docker-setup","posts_count":5,"reply_count":3,"highest_post_number":5,"image_url":null,"created_at":"2026-01-21T01:36:03.877Z","last_posted_at":"2026-05-04T16:41:12.456Z","bumped":true,"bumped_at":"2026-05-04T16:41:12.456Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":404,"name":"gemini-embedding","slug":"gemini-embedding"}],"tags_descriptions":{},"views":255,"like_count":0,"has_summary":false,"last_poster_username":"Clintin_Brummer1","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"To resolve extremely slow EmbeddingGemma indexing within Dify's Docker setup, solutions involve ensuring GPU passthrough, reducing document chunk batch size, and increasing allocated CPU cores and RAM for improved hardware utilization.","has_accepted_answer":true,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":87422,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster, Accepted Answer","user_id":48451,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":65150,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Regression: Gemma-4-E4B-it cannot initialize on mobile (LiteRT Engine Error)","fancy_title_localized":false,"locale":null,"id":138016,"title":"Regression: Gemma-4-E4B-it cannot initialize on mobile (LiteRT Engine Error)","slug":"regression-gemma-4-e4b-it-cannot-initialize-on-mobile-litert-engine-error","posts_count":7,"reply_count":2,"highest_post_number":7,"image_url":null,"created_at":"2026-04-05T17:00:24.811Z","last_posted_at":"2026-05-04T16:37:37.842Z","bumped":true,"bumped_at":"2026-05-04T16:37:37.842Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":17,"name":"github","slug":"github"}],"tags_descriptions":{},"views":846,"like_count":1,"has_summary":false,"last_poster_username":"Clintin_Brummer1","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Gemma-4-E4B-it model's mobile initialization failure due to LiteRT Engine Error is linked to memory limits or runtime aborts, with fixes suggested as 4-bit quantization, sufficient swap space, and updated LiteRT dependencies.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":119316,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":78090,"primary_group_id":null,"flair_group_id":null},{"extras":null,"description":"Frequent Poster","user_id":120613,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":65150,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 4 27B-A4B-it (MoE) on Vertex AI: vLLM Dependency Triangles, LoRA, and Vision Blockers","fancy_title_localized":false,"locale":null,"id":141868,"title":"Gemma 4 27B-A4B-it (MoE) on Vertex AI: vLLM Dependency Triangles, LoRA, and Vision Blockers","slug":"gemma-4-27b-a4b-it-moe-on-vertex-ai-vllm-dependency-triangles-lora-and-vision-blockers","posts_count":2,"reply_count":0,"highest_post_number":2,"image_url":null,"created_at":"2026-04-22T18:44:04.063Z","last_posted_at":"2026-04-27T12:54:11.518Z","bumped":true,"bumped_at":"2026-04-27T12:54:11.518Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":20,"name":"models","slug":"models"},{"id":42,"name":"vertexai","slug":"vertexai"},{"id":347,"name":"transformers","slug":"transformers"},{"id":308,"name":"pytorch","slug":"pytorch"},{"id":40,"name":"gemma","slug":"gemma"}],"tags_descriptions":{},"views":338,"like_count":0,"has_summary":false,"last_poster_username":"Pannaga_J","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Critical architectural blockers, such as dependency triangles and LoRA incompatibility, hindering Gemma 4 27B-A4B-it deployment on Vertex AI with vLLM, have been escalated to the engineering team.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":125575,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":48451,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 4 really good with Ollama","fancy_title_localized":false,"locale":null,"id":140553,"title":"Gemma 4 really good with Ollama","slug":"gemma-4-really-good-with-ollama","posts_count":2,"reply_count":0,"highest_post_number":2,"image_url":null,"created_at":"2026-04-16T13:57:40.714Z","last_posted_at":"2026-04-26T17:36:40.189Z","bumped":true,"bumped_at":"2026-04-26T17:36:40.189Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":261,"name":"language-translator","slug":"language-translator"}],"tags_descriptions":{},"views":156,"like_count":1,"has_summary":false,"last_poster_username":"Pannaga_J","category_id":10,"op_like_count":0,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Gemma 4 is performing well for local string translations, including Arabic, using custom system prompts to provide context, with positive feedback shared on its effectiveness.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":123628,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":48451,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Constant 500s with Gemma","fancy_title_localized":false,"locale":null,"id":142215,"title":"Constant 500s with Gemma","slug":"constant-500s-with-gemma","posts_count":2,"reply_count":0,"highest_post_number":2,"image_url":null,"created_at":"2026-04-24T18:27:27.470Z","last_posted_at":"2026-04-24T20:50:18.003Z","bumped":true,"bumped_at":"2026-04-24T20:50:18.003Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":8,"name":"api","slug":"api"}],"tags_descriptions":{},"views":276,"like_count":1,"has_summary":false,"last_poster_username":"Nathan_Rixham","category_id":10,"op_like_count":1,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"Users are experiencing constant 500 Internal Errors when using the Gemma API, with recent reports confirming issues with `GetInteractionHttp` via the interactions API since 18:04 UTC, while `CreateInteractionHttp` is functioning correctly.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":null,"description":"Original Poster","user_id":94539,"primary_group_id":null,"flair_group_id":null},{"extras":"latest","description":"Most Recent Poster","user_id":106952,"primary_group_id":null,"flair_group_id":null}]},{"fancy_title":"Gemma 4 Mobile Development","fancy_title_localized":false,"locale":null,"id":141051,"title":"Gemma 4 Mobile Development","slug":"gemma-4-mobile-development","posts_count":1,"reply_count":0,"highest_post_number":1,"image_url":null,"created_at":"2026-04-19T07:54:24.000Z","last_posted_at":"2026-04-19T07:54:24.084Z","bumped":true,"bumped_at":"2026-04-19T07:54:24.084Z","archetype":"regular","unseen":false,"pinned":false,"unpinned":null,"visible":true,"closed":false,"archived":false,"bookmarked":null,"liked":null,"tags":[{"id":40,"name":"gemma","slug":"gemma"}],"tags_descriptions":{},"views":254,"like_count":1,"has_summary":false,"last_poster_username":"Clintin_Brummer1","category_id":10,"op_like_count":1,"pinned_globally":false,"featured_link":null,"ai_topic_gist":"An updated technical log details comprehensive fixes for compilation, runtime, data pipeline, tooling, and interaction errors encountered while deploying Gemma models on ARMv8/Android edge hardware, focusing on a 416-space localized architecture.","has_accepted_answer":false,"can_vote":false,"posters":[{"extras":"latest single","description":"Original Poster, Most Recent Poster","user_id":65150,"primary_group_id":null,"flair_group_id":null}]}]}}